「多模型 Agent」共找到 11003 篇相关文章

新闻资讯8

摆脱遥控器,波士顿动力人形机器人,开始「长脑子」干活了

世界人形机器人运动会引发对人工遥控机器人的争议。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型,展示其自主收纳整理成果,模型构建有流程,成果显著,研发遵循三项核心原则。

机器之心
算法论文8

OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式

现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。

带你学AI
开源动态8

华为| 祭出FlashComm1,FlashComm2、FlashComm3,解决LLM推理通算瓶颈

在大模型推理面临通算难题背景下,华为数学家祭出FlashComm 1、2、3。如FlashComm 1优化AllReduce通信,提升推理性能;FlashComm 2重构计算流程,提升推理速度;FlashComm 3实现多流并行,激增模型吞吐。

AINLPer
算法论文8

LLM的下一战:从狂卷数据到精算数据

大模型竞争核心正从比拼数据规模转向数据使用效率和风险管理。文章分享2025两篇论文,介绍高效训练和机器遗忘两赛道,前者有数据价值飞轮5大模块,后者提出三时段分类法、三层次遗忘及评价指标全景。

PaperAgent
算法论文8

EMNLP2025 | LLM多次回答一致就一定正确吗?非也

随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力。

深度学习自然语言处理
新闻资讯7

150万个Clawdbot挤爆了一个AI论坛,而人类只配围观。

Moltbook是面向AI的论坛,类似Reddit。短短两天有几万帖子、上万子版块和近150万个Agent账号,人类只能围观。它由开发者Matt Schlicht搭建,文中介绍注册方法,也提及使用规则和作者体验。

数字生命卡兹克
推荐文章8

视觉生成的另一条路:Infinity 自回归架构的原理与实践

本文整理自字节跳动韩剑在AICon 2025北京站的分享,以Infinity为例介绍自回归视觉生成原理,对比其与扩散模型,展示Infinity升级方案成果,它在高分辨率文本到图像任务能与扩散模型竞争。

InfoQ
开源动态8

Hugging Face 推出九大 AI 课程,免费、全面【收藏】

Hugging Face悄悄上线一批免费AI课程,还带认证证书。课程从大语言模型到扩散模型,从计算机视觉到游戏AI,覆盖面广。完成课程可拿证书,还能在平台分享成果,是学习AI的好机会。

AGI Hunt
新闻资讯7

MiniMax修改开源授权被骂疯了!限制M2.7商用、强制标注来源,却没完全撤下MIT标识

近日,MiniMax M2.7 模型变更开源使用条款,收紧商业授权,引发社区热议。MiniMax 称此举为防第三方‘阉割降级’模型。但标注‘Modified - MIT’却限制商用引开发者质疑,此前 MiniMax 一直完全开源。

AI前线
产品应用8

Gemini 3 Pro的位置,Kimi K2.5也想坐坐?

Kimi 发布 K2.5,在视觉编程上表现亮眼。它通过多模态训练涌现审美,能生成美观网页。与 Gemini 3.0 对比各有优势,Kimi Code 开源终端 Agent 功能强大,Kimi 还探索 Agent Swarm 协作新路径。

AGI Hunt