模型并行」共找到 7889 篇相关文章

推荐文章7

别再构建多智能体了

Multi Agent应用有望成大模型应用范式,但Cognition AI团队认为2025年追求多智能体并行协作架构是歧途,存在信息孤岛和决策冲突问题。主张采用单线程线性架构与上下文工程。

AI工程化
推荐文章8

怎么做 Long-running Agents,Cursor、Anthropic 给了两种截然不同的思路

业界对让 Agent 长时间运行、执行复杂任务无共识。最近 Cursor 和 Anthropic 分享实践,思路不同。Cursor 用多 Agent 并行执行长时任务,Anthropic 解决单个 Agent 跨工作周期的记忆连续性问题。

Founder Park
算法论文8

打破视频推理「先看后想」惯性,实现真正的「边看边想」丨CVPR'26

现有大型视觉语言模型(VLM)在实时场景表现不佳,宁波东方理工大学沈晓宇团队提出TaYS,让VLM从“帧文交错”切换到“并行”,实现“边看边想”,在准确性和延迟上表现出色,推动VLM走向更真实应用。

量子位
开源动态8

你敢信?GPT-5的电脑操作水平只比人类低2%了

Agent S3刷新了计算机使用智能体(CUA)在「OSWorld」基准测试的记录,性能达69.9%,接近人类水平。它引入bBoN实现并行扩展,还精简框架、引入原生代码智能体,已开源并发布论文。

机器之心
8

DeepMind夺得IMO官方「唯一」金牌,却成为OpenAI大型社死现场

谷歌DeepMind宣布其Gemini进阶版模型在IMO竞赛达金牌水平,解决五道超高难度试题,首次证明AI仅靠自然语言理解就能攻克复杂数学难题。其谨慎发布方式获赞誉,与OpenAI形成鲜明对比。

机器之心
开源动态8

蚂蚁具身研究首次亮相!就解决了机器人「看」透明玻璃这些难题,还开源了

蚂蚁灵波科技开源高精度空间感知模型 LingBot-Depth,针对性解决机器人识别真实世界的「玻璃问题」。其构建双线并行数据集,提出掩码深度建模思路,在深度补全等任务中表现出色,且已具备落地能力。

机器之心
新闻资讯8

红杉专访 OpenAI Codex 团队:AI Coding 的未来,应该是异步自主 Agent

红杉专访 OpenAI Codex 团队,探讨 AI Coding 未来。OpenAI 5 月推出的 Codex Agent 可并行处理多任务、独立完成编程全流程。从代码补全到任务委托,AI 编程朝解放生产力方向发展,团队分享了产品思考等内容。

Founder Park
算法论文8

单向VLM变双向!人大斯坦福等提出MoCa框架:双向多模态编码器

人大、斯坦福等机构提出MoCa框架,将单向视觉语言模型转化为双向多模态嵌入模型。它通过持续预训练和异构对比微调,解决传统模型局限,在多模态基准测试中表现优异,尤其小规模模型性能突出。

新智元
开源动态8

MetaShuffling:Meta的Fused MoE kernel工程方案,更激进的Kernel优化和尽量避免Padding

文章介绍Meta的Fused MoE kernel工程方案MetaShuffling,可高效部署Llama 4模型。它处理MoE推理挑战,介绍多种token选择路由方案,阐述运行时设计、不同并行化方式及优化思路,还展示性能测试与Trace分析。

GiantPandaLLM
算法论文7

谷歌研究院探索多智能体协调的扩展原则

谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现多智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。

InfoQ