「多智能体大语言模型」共找到 9745 篇相关文章

算法论文8

西交大 x A*STAR 论文:让 AI 学会「保持一致」,多图生成迎来关键突破丨CVPR 2026

西安交大与新加坡A*STAR团队提出论文《PaCo-RL: Advancing Reinforcement Learning for Consistent Image Generation with Pairwise Reward Modeling 》,将一致性问题转为“跨图比较”学习问题,结合强化学习实现能力闭环,提升多图生成一致性。

AI科技评论
开源动态8

AIME'25满分炸场!Qwen一波七连发,全家桶大更新

云栖大会上,通义团队成果丰硕。Qwen3-Max性能提升,数学评测满分,多测试成绩优异;Qwen3-VL、Qwen3-Omni等开源,各有亮点;Qwen3-Coder升级。吴泳铭称要发展超级人工智能。

量子位
推荐文章7

五源袁野:理解AI创业的五个视角 |5Y View

文章是五源合伙人袁野在五源2025创始人年会演讲,从五视角审视AI时代创业变化,如技术范式切换、供给边界演进等,为理解AI创业带来启发,强调创新要敢于走新路。

五源资本 5Y Capital
算法论文8

镜头被油污糊住,机器人还稳定操作?北大/清华等给VLA加一道信息筛选,不靠额外数据,效率提升14x,真机鲁棒性反而更高了 | ICML 2026

北大、清华等机构联合提出StableVLA,相关工作被ICML 2026接收。该工作提出轻量级IB - Adapter,不依赖额外数据对视觉特征筛选对齐,让机器人遇视觉干扰仍能稳定执行任务,实验展现出鲁棒性提升。

量子位
新闻资讯7

谢尔盖·布林重启「创始人模式」?谷歌组建「突击队」,重押「AI编程」

近日媒体报道,谷歌组建由研究人员和工程师构成的“突击队”,提升AI编程模型能力,推动编码工作自动化。谷歌创始人谢尔盖・布林等参与其中,因Anthropic发布模型刺激,谷歌急起直追。

机器之心
开源动态7

Agent Team 实践与架构设计:在约束下构建可演进的一个人开发团队

作者结合构建的Routa,探讨在Token、流程、工具选择等约束下构建可演进的多Agent系统。介绍了Routa架构、原则,如跨Agent通信、状态外置等,还阐述了各设计要点及示例,强调系统可演进性。

phodal
开源动态8

工程师狂喜!Qwen3-VL 检索双雄效率翻倍

通义大模型开源Qwen3-VL-Embedding和Qwen3-VL-Reranker,解决多模态检索难题。两模型多模态全兼容,双塔+单塔协同提速,实用主义拉满,集成成本低,实战表现超预期。

CourseAI
产品应用8

Vibe Coding杀进3D领域!OpenAI总裁都在围观这种新玩法

AI 3D 基础模型领先公司 VAST 发布 Tripo P2.0,直接产出原生四边面拓扑,解决生成后模型可用性问题。此外,VAST 完成约 30 亿融资,Tripo 系列在评测中居首。

机器之心
开源动态8

开源项目 | 用自然语言做视频剪辑,人人都能用的 AI 视频剪辑工具

FireRed - OpenStoryline是开源AI视频剪辑智能体,理念是‘你说话,它剪片’。工作流程为‘理解→执行→输出’。具备智能素材搜索、文案生成等多项能力,适用于多场景,介绍了安装方式、优缺点。

小华同学ai
新闻资讯8

老黄在CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素

黄仁勋在CES 2026预言,应用将告别预编译时代,在GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。

宝玉AI