多智能体社会实验」共找到 4546 篇相关文章

开源动态7

又一个开源 AI Agent 杀到!II-Agent,号称“全球最强”,击败 Genspark 和 Manus,跑分直逼人类

AI Agent 赛道迎来新成员 II-Agent,由 Intelligent Internet 团队打造且将开源,获前 Stability AI CEO 站台。它性能强、可扩展,GAIA 跑分亮眼,团队认为未来是 Agent 群的天下,还计划为多领域构建开源 Agent。

AI进修生
产品应用8

上海AI实验室发布 Intern Lumina U2:全离散扩散建模,让模型既能“看懂”也能“生成”

上海人工智能实验室发布新一代多模态统一模型 Intern Lumina U2,基于全离散扩散建模路线,支持多任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。

OpenMMLab
新闻资讯8

GPT-6 Astra发布,多个基准测试接近满分,“欢迎来到AGI时代”?

当地时间9月3日,OpenAI发布GPT-6 Astra,称其为“最智能、最对齐”的模型。它在多测试表现逆天,能力提升显著,还加入新特性。不过价格更高,也带来安全问题。

DeepTech深科技
算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做体检?

随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
新闻资讯7

中科院自动化所孵化的矿山物理AI龙头,国家队与产业资本为何集体重仓|甲子光年

2026年物理AI热度攀升,概念也趋于泛化,产业和资本更关注其实际价值。矿山场景或成Physical AI首个盈利点。中科慧拓由中科院自动化所孵化,其平行矿山方案已落地近50座国内矿山,并实现海外项目落地。

甲子光年
算法论文7

从 RLVR 到 RLSVR:开放式任务如何获得可核验奖励

COLM 2026 论文提出 RLSVR 及 SpyRL,把摘要等开放任务变成“谁是卧底”游戏,用投票生成可核验奖励,在多任务有提升,但也暴露代理目标与质量关系、成本等问题。

深度学习自然语言处理
新闻资讯7

360 周鸿祎:做中国版 Mythos 不能照搬美国路线,基模能力的差距可以通过Harness补齐

过去几月,Anthropic的Mythos模型成全球网络安全焦点。360周鸿祎在ISC.AI 2026上发布‘图龙锋’和‘仪天阵’,欲做中国版Mythos,还发起‘磐石之盾’计划。他认为不能照搬美国路线,可通过Harness弥补基模差距。

InfoQ
算法论文8

让机器人学会「预判接触」:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题

它石智航联合四大顶尖机构发布论文 “TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在真机验证中性能优异。

机器之心
新闻资讯8

Anthropic首次揭秘下一代Claude怎么造!用户吐槽直接喂模型,连AI“做梦”都被训练

Anthropic研究团队产品经理Alex在访谈中透露Claude演进方向,如将模型开发产品化、向“持续运行Agent”演化,还解释“dreaming”机制等,也提及训练“人格”、研究意识等,展现了长远思考。

InfoQ
推荐文章7

字节、阶跃之后,张心皓押注Human Loop:Agent Loop赢家通吃,创业要走另一条路

张心皓曾在字节跳动工作10年,后创业,现做Jovida,目标是“从愿望到行动零摩擦”。他认为Claude Code定义纯Agent Loop上限,创业应做Agent in Human Loop,还分享了产品理念、架构、商业化等看法。

Founder Park