「规划与执行」共找到 7018 篇相关文章
小白也能看懂,一文彻底说清 MCP、A2A与AG-UI,大模型应用集成协议三件套。
文章面向有一定技术基础但不熟悉大模型应用开发的读者,通俗介绍MCP、A2A和AG - UI三大主流集成协议,分别解决不同的集成难题,三者构成大模型应用集成完整生态。
Gemini 首次反超 ChatGPT,谷歌CEO劈柴哥复盘:不止是十年算力与全栈豪赌,更是找回了“老谷歌”那个味儿
截至2025年底,Gemini在桌面和移动端单次使用平均停留时长首超ChatGPT,下载量也快速追赶。谷歌将其嵌入自家生态策略见效,这与Gemini 3推出有关,还体现了全栈能力与早期谷歌文化回流。
《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造
研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。
国家定调「人工智能+」:中国AI十年三步走,战略解读来了
2025年8月国务院印发《行动意见》,为AI发展绘就至2035年蓝图。提出“三步走”,还聚焦模型、数据、算力、开源等方面发展,强调监管安全,体现中国AI发展新方向与治理新思路。
ICLR 2026|在「想象」中进化的机器人:港科大×字节跳动Seed提出WMPO,在世界模型中进行VLA强化学习
香港科技大学 PEI - Lab 与字节跳动 Seed 团队提出 WMPO 新范式,可让具身智能在‘想象中训练’,解决传统 VLA 训练瓶颈,目前论文、代码与模型均已开源。
GAN之父Ian Goodfellow病后归来,剑指高效世界模型
GAN之父Ian Goodfellow等提出,利用符号化表示和游戏虚拟世界数据,或为构建动作条件多模态世界模型最佳路径,该模型可支持长时序任务预测与规划,还探讨构建原因、数据来源等。
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换
视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。
AI 智能体界的 npm 来了!Vercel 推出 Skills.sh,欲统一智能体指令集
Vercel 发布开源项目 Skills.sh,为 AI 智能体打造“标准动作库”,让其通过命令行执行可复用操作。它是开放生态,开发者能定义、分享指令。项目获广泛关注,社区认为其实用性强。
老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素
黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。
CVPR 2025 Highlight|北大联手智元发布首个基于说明书的家电操作评测基准
北大联合智元团队提出全新家电操作评测基准 CheckManual,被 CVPR 2025 接收并评为 Highlight。它有拟真说明书与多样资产、契合实际的评测任务、首个操作规划模型 ManualPlan 等优势,还做了相关实验。