「多Agent协同」共找到 6333 篇相关文章
王小川:医疗行业对大模型有三大刚性要求,但通用模型一条都不达标
5月22日百川智能展示医疗大模型Baichuan - M4与AI家庭医生「百小医」。王小川指出通用大模型用于医疗有问题,医疗对大模型有低幻觉、强循证、会提问的刚性要求,而通用模型不达标。Baichuan - M4表现出色,百小医也有独特定位和优势,且与三家顶尖医院合作成果显著。
驾驭AI的人,才是穿越周期的竞争力|2026极客时间DTDS大会圆满落幕
2026年5月极客时间企业版联合《培训》杂志举办DTDS大会,四位产业一线实践者拆解企业AI转型难题。协鑫科技张诗笳给出AI人才培养体系;赵钰莹发布8大岗位AI技能图谱;广新集团李志刚分享创新加速三步法;黄林给出未来趋势判断与诊断模型。
GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」
大模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型上性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。
量产倒计时!三星DRAM工艺实现突破
韩媒报道三星电子成功制造全球首款“次10纳米”DRAM工程裸片。其突破源于“4F²单元结构”与垂直沟道晶体管(VCT)两项核心技术协同,还革新材料。三星规划10a DRAM 2028年量产,后续迈向3D DRAM。
Claude Code auto mode 解析:如何用 AI 分类器替代人工审批
Anthropic 发布 Claude Code 的 auto mode 解决审批疲劳问题,用 AI 分类器替代人工审批。介绍了其核心思路、判断危险的标准、两阶段分类等,还分析了漏检率、被拦截后的处理及子 Agent 检查等,也指出了目前局限。
上下文工程又进化了:Harness实现AI完全自主化
近期Harness Engineering讨论火热,Harness是围绕AI模型的支撑架构,Anthropic用其突破AI局限,解决AI完成复杂任务时的偷懒问题,还通过多智能体架构用于前端设计、软件开发,经实战检验效果良好,后续还对其进行简化。
ChatGPT和Claude争了个寂寞!用户重叠仅11%,中国应用霸榜移动端
风投机构a16z发布“迄今最受消费者喜爱的Top100 AI应用”榜单。前50个移动AI应用近半来自中国团队,用户多在海外。ChatGPT领先但挑战者来势汹汹,其与Claude用户重叠仅11%,全球形成三大AI市场。
龙虾社交上线40天被Facebook收购!俩文科创始人加入超级智能实验室
刚上线40天的AI Agent社交网站Moltbook被Meta收购,两位文科创始人将加入Meta超级智能实验室。Moltbook因人类冒充AI的假帖子爆火,但安全漏洞明显。Meta看中其让AI智能体在线连接的能力,或优先修复安全问题。
豆包 Seed 2.0 来了:字节模型跨越鸿沟
春节前字节发布豆包大模型 2.0,其在 Text 领域进入榜单前十,视觉能力全球第四且成本低。它定位多模态 Agent 模型,有多种能力升级,文中用多个案例展示其强大,还强调字节重原生能力非简单蒸馏。
ICLR 2026 Oral | 西湖大学发布Real PDE Bench
复杂物理系统时空演化预测是核心问题,当前AI模型多在数值仿真数据上训练,难以评估其在真实数据上的表现。西湖大学等实验室提出RealPDEBench,含真实与仿真数据,设三类任务、九个评估指标和十个基线方法。