「多agent协调」共找到 6142 篇相关文章
云知声发布U2-Flash,要争“大模型主力位”|甲子光年
本文报道云知声发布U2-Flash大模型,基于原有U2基座,通过创新后训练方案提升Coding、Agent等复杂任务能力,多项评测比肩头部模型,目标成为企业真实生产任务的主力大模型。
Action Map Policy:从高维动作回归到像素分类,一种新的机器人操作学习范式
本文介绍美国东北大学博士生黄浩杰提出的全新机器人操作学习范式Action Map Policy(AMP),将高维三维机器人动作转化为二维图像空间的像素分类问题,性能和推理速度均显著优于现有主流基线方法。
智能流体力学专题研讨会特邀报告4|卢臻:基于 Koopman 方法的非线性动力学端到端量子模拟
2026年8月,第十四届全国流体力学学术会议在山东青岛举行,智能流体力学专题研讨会展示了人工智能、机器学习与流体力学交叉领域研究进展。本次分享《基于Koopman方法的非线性动力学端到端量子模拟》报告,团队来自多机构。
GPT-6 Astra:欢迎来到 AGI 时代。
OpenAI 发布 GPT - 6 Astra,总裁称开启 AGI 时代。演示视频展示其强大并行处理能力,跑分有争议,成绩不一。它有诸多成果和安全表现,也有可监控性降低问题,发布过程却状况百出。
蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据
蚂蚁集团论文《OmniTable: A Unified Wide-Table System for Petabyte-Scale LLM Data Curation and Exploration》获VLDB工业赛道最佳论文。其研发的OmniTable系统能管理超35PB、3050亿条以上训练数据,解决数据准备难题,如在SFT任务中大幅缩短周期。
拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」
Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还体现了能力权限分离等变化。
NovaSilicon发表新论文:造芯的瓶颈不在工具,而在组织
NovaSilicon发表论文探讨超级智能在芯片领域的运用。随着芯片复杂度提升,传统EDA方法遇瓶颈,论文提出将芯片设计超级智能建模为AI组织,利用LLM等技术,重塑芯片设计行业,实现产业链智能化升级。
DeepSeek睁开眼了!Opus-4.8的性能,1000张图不到20美分
DeepSeek首个多模态视觉模型deepseek-v4-flash-vision-exp上线DeepSeek API平台。文本能力与V4-Flash持平,多模态Agent能力逼近Opus-4.8,分析1000张图成本不到20美分,还上线免费Files API。
紫东太初推出GMC核心集剪枝方法,少80%Token仍满血保真多模态能力
视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。
评论送书 | 想系统了解AI?先搞清楚这四件事
文章围绕系统了解AI需搞清楚的四件事展开,介绍了AI理论基础层的机器学习和深度学习,感知交互层的计算机视觉等,应用实践层的机器人学等,还提及伦理社会层的AI伦理和社会影响研究。