「多智能体协同编程」共找到 4272 篇相关文章
Uber&WisdomAI揭露95%AI Agent落地失败的真相 !
在‘Beyond the Prompt’技术论坛上,Uber、WisdomAI等企业揭开AI智能体落地难症结。指出90%失败源于‘喂错料’,信任是落地‘生死线’,记忆是架构设计,多模型编排与场景化交互决定用户体验上限。
景不动人动,MLLM如何面对「移步换景」的真实世界?OST-Bench揭示多模态大模型在线时空理解短板
上海多所高校研究者提出 OST - Bench,从智能体探索场景动态在线视角挑战大模型能力。它更贴近真实世界,揭示主流多模态大模型在线时空理解短板,为未来模型发展指明方向。
「微调已死」再添筹码,谷歌扩展AI自我进化范式,成功经验与失败教训双向学习
近期,‘微调已死’言论引关注。谷歌《ReasoningBank: Scaling Agent Self - Evolving with Reasoning Memory》论文提出类似概念,可让智能体从自身成败经验学习,还引入MaTTS,实验显示其有效性和效率优于基准方法。
RL 将如何提高具身大模型 VLA 泛化性?清华大学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异
清华大学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身大模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。
Google封神,计算机视觉的GPT3时刻来了!
Google Deepmind称在CV领域做出类似GPT-3的成果,Veo 3经大规模训练涌现通用视觉理解和推理能力,能以图片+提示词完成复杂视觉任务,还具备感知、建模等四大超能力。
Claude Sonnet 4.5 发布,30 小时自主编码刷新行业纪录
Anthropic发布Claude Sonnet 4.5,号称最强编程模型,自主编码达30小时。它性能超GPT-5等,Claude Code升级,文件处理、API能力增强,价格不变,多平台集成,还通过白盒审计提升安全性。
稚晖君机器人炸场:全球首秀“真男人必会的韦伯斯特空翻”
智元的灵犀X2成全球首个完成韦伯斯特空翻的机器人,该动作对腿部爆发力和协调性要求高。稚晖君介绍其攻克难点的原理,完成此动作验证了硬件可靠性,也体现机器人应对复杂环境的能力。
全球图生视频榜单第一,爱诗科技PixVerse V5如何改变一亿用户的视频创作
爱诗科技PixVerse(拍我AI)功能丰富,普通用户可用热门模板整活,创作者有多样创作工具。其最新V5模型在图生视频项目全球排名第一,在多方面技术革新,推动AI视频创作发展。
专访 RockFlow Vakee:AI 如何重构投资体验,让金融“说人话”
该专访对话 RockFlow 创始人 Vakee,探讨 AI 重构投资体验。她分享创业初衷、团队理念及人才需求,还谈及 GenZ 投资特点与 RockFlow 应对策略,介绍了 Bobby 功能、规划及 RockFlow 在金融科技领域的发展方向。
特斯拉下一代金色Optimus原型现身?一双「假手」成为最大槽点
Salesforce CEO发布与金色Optimus对话视频,盛赞其开启物理智能体革命。不过,其高昂价格、“假手”设计引争议。对比Figure机器人精准装碗视频,特斯拉Optimus表现不尽如人意,是否遇麻烦引人猜测。