「豆包大模型1.6」共找到 8869 篇相关文章
给 Agent Skills 装上眼睛:MMSkills 用多模态技能包教会智能体看状态、做决策
上海交通大学和小红书团队推出面向通用视觉 Agent 的多模态技能框架 MMSkills,将可复用技能扩展为多模态程序性知识,通过 branch loading 调用视觉证据,在 GUI 与游戏任务评测中表现出色。
保姆级教程!DeepSeek V4 可在 Claude Cowork 直接调用,无需订阅免登录且保留完整体验
DeepSeek V4可在Claude Cowork直接调用,无需订阅免登录。介绍了接入后能获得完整桌面端体验,还给出获取DeepSeek API Key、开启开发者模式等完整配置方法。
玩转智能体协议:谷歌开发指南教你拼出工业级AI应用
谷歌两篇开发指南拆解六大前沿开放协议核心代码,从开发者挑战赛提炼五条架构法则。介绍各协议用途,如MCP消除重复劳动,A2A规范智能体通信等,阐述协议协同运作及架构法则助力工业级智能体应用开发。
Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文
谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。
字节最火的开源Agent项目,如何思考Agent的自我进化?
4月5日,LangChain创始人Harrison Chase阐述对Agent自我进化的思考,认为Agent系统可在Model、Harness、Context三层持续进化。知名开源框架DeerFlow联合作者Daniel也补充了团队思考。
ICLR 2026|与上海AI实验室里约相见:北极星X星启交流会邀约全球AI英才
ICLR 2026 将于 4 月 23 日至 27 日在巴西里约热内卢召开,收到超 1.9 万篇有效投稿,录取率约 28%。同期上海 AI 实验室将举办交流会,邀全球 AI 英才,搭建学术与产业对话桥梁。
OCR 赛道变天了:Datalab 要亲手杀死自己
Datalab推出Chandra模型,指出老一代pipeline OCR已到天花板。它从“切块识别”转向“整页理解”,在布局感知、数学支持、表格表单处理上表现出色,标志OCR从“识别字符”进入“理解文档”阶段。
刚刚,Claude Mythos敲响末日警钟!超级智能已在悬崖,Hassabis深感恐惧
前沿AI已能自主攻击、逃逸,Anthropic因太危险暂不发布Claude Mythos Preview模型。谷歌DeepMind掌门人Hassabis、OpenAI CEO奥特曼均发出警告,虽恐惧AI风险却仍推进开发。
会挖0-day漏洞!凶残版Claude官宣却不让用,微软苹果齐下场“看守”,Anthropic到底在图什么?
Anthropic官宣Mythos Preview,却未将其放给普通人用,而是塞进防御联盟Glasswing。Mythos在漏洞发现和利用上能力超多数人类,Anthropic怕其引发风险,先将它组织进防守体系,还试图占据‘负责任的frontier lab’位置。
The Batch: 936 |Claude Code 内部揭秘
广受欢迎的编码智能体Claude Code近期版本意外暴露底层代码。Anthropic称是人为失误,未泄露用户数据。工程师分析发现其架构似小型专用操作系统,还揭示了潜在功能和未来规划。