「多智能体推理能力」共找到 7051 篇相关文章
230个大模型在婴幼儿认知题上集体翻车!揭秘多模态大模型的核心知识缺陷
ICML 2025研究揭示多模态大模型在基础认知能力上表现不佳。研究者建测评题库CoreCognition测试230个主流模型,发现其存在核心知识缺陷,扩规模难补短板,还需补齐核心知识。
出自小米的模块化图像编辑改造:让 AI 学会「搭积木」
小米研究团队发布 Lego-Edit 图片编辑框架,将复杂编辑任务拆成工具集和调度系统,工具集模型各司其职,调度系统指挥操作。采用渐进式训练,性能优、扩展性好,体现协同智能优势。
绝美无痕,比你还会P图的Agent!仅通过自然语言指令,灵活使用数百工具,超越GPT-4o达60%
JarvisArt提出多模态大模型驱动的智能Agent,通过理解自然语言指令,协调200+个Lightroom工具,实现媲美专业修图师的非破坏性编辑。其内容保真度超越GPT - 4o达60%,为AI艺术创作开辟新路径。
让AI主动干活,给你找服务,鸿蒙“6”啊
在HDC 2025上,鸿蒙展示服务分发展示新能力,能让服务主动找用户。它形成Agent行动网络,推出“探索”服务流。奈雪、东方财富等已加入,华为为开发者提供多种工具及激励政策。
揭示扩散语言模型扩展定律,人大高瓴团队与蚂蚁集团发布LLaDA MoE v2
中国人民大学高瓴人工智能学院与蚂蚁集团合作,首次系统刻画混合专家扩散语言模型扩展定律,据此训练LLaDA MoE v2,实现扩展效率与智能双重突破,将推动其迈向规模化时代。
西方忘了怎么制造东西,现在它又在忘记代码
文章以国防工业为例,指出西方制造业存在知识流失、产能恢复困难问题。如重启“毒刺”导弹生产线困难,欧洲炮弹交付延期。软件行业也类似,AI使初级工程师能力培养受阻,可能重蹈覆辙。
The Batch: 936 |Claude Code 内部揭秘
广受欢迎的编码智能体Claude Code近期版本意外暴露底层代码。Anthropic称是人为失误,未泄露用户数据。工程师分析发现其架构似小型专用操作系统,还揭示了潜在功能和未来规划。
“龙虾”时代,大模型公司的好日子来了
3月10日,MiniMax港股收涨,市值超百度。OpenClaw爆火,其创始人转发评测榜单,使MiniMax-M2.1排名突出。OpenClaw是智能体构建框架,为大模型公司带来盈利转机,撬开收入天花板,引发各方关注。
独一份!带动效的 PPT 生成 Agent!使用教学&创作思路
作者实现用 Nano Banana Pro 生成带演示动画的 PPT 这一独特功能。介绍了更新后的 PPT 生成 Skills 能力、使用方法、创作思路,还提及成本及对 AI Coding 发展的看法。
一键将 Markdown 和网页 AI 对话完美粘贴到 Word、WPS 和 Excel 的效率工具
PasteMD是常驻托盘的小工具,能从剪贴板读取Markdown,调用Pandoc转换为DOCX插入到Word/WPS光标位置。还有新功能,如智能识别Markdown表格粘贴到Excel等,介绍了使用、配置等内容。