「AI突破」共找到 10152 篇相关文章

新闻资讯7

别只盯着李飞飞!AI的「3D数据底座」已被这家中国公司悄悄建好

群核科技构建具身智能时代的「3D版ImageNet」,其SpatialVerse平台为机器人提供三维数据与仿真环境。借助新技术发布全球首个3D语义数据集InteriorGS,还与多机构合作,成果获学术和产业认可。

新智元
算法论文8

AI 如何讲好一个多人故事?首个支持多角色互动的3D场景叙事系统

首尔国立大学提出全新框架,能生成虚拟动态场景并支持多角色上下文动作生成。引入LLM拆解复杂任务,系统用事件驱动方式规划动作,还构建基准评估相关能力,有良好扩展性和实用性。

带你学AI
算法论文8

奖励模型预训练新范式POLAR:突破强化学习短板,有望打通RL链路扩展“最后一环”

强化学习中奖励模型设计与训练是瓶颈,上海人工智能实验室提出奖励建模新范式POLAR。它摆脱传统“绝对偏好”限制,契合强化微调框架,通过对比学习训练,实验证明其性能和泛化性佳,有望打通RL链路扩展最后一环。

OpenMMLab
开源动态8

DeepSeek-R1超级外挂!“人类最后的考试”首次突破30分,上海交大等开源方案碾压OpenAI、谷歌

上海交大联合深势科技团队发布新研究,在“人类最后的考试”(HLE)上获32.1分创纪录。团队推出工具增强推理智能体X - Master、多智能体工作流系统X - Masters并开源,方案表现优于OpenAI、谷歌相关模型。

量子位
新闻资讯8

@所有开发者:Agent变现,阿里云百炼联合支付宝首创「AI打赏」!Agent Store全新发布

2025年是Agent元年,不过很多项目卡在POC阶段。6月25日阿里云百炼3.0全新升级,联合支付宝推“Agent打赏”功能,还上线Agent Store。此外,它升级多模态RAG和MCP能力,推出多模态交互开发套件。

量子位
算法论文8

AI哪怕答案正确,逻辑链却惨不忍睹,奥数级不等式证明成功率不到50%| 斯坦福&伯克利&MIT

斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级不等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。

量子位
算法论文8

北大伯克利联手“拷问”大模型:最强Agent也才40分!新基准专治“不听话”的AI分析师

北大与伯克利团队推出IDA - Bench新基准,模拟真实数据分析场景,解决现有基准无法评估大模型在动态交互中可靠性的问题。测试显示,顶尖大模型成功率最高仅40%,不同模型还暴露多种问题。

量子位
新闻资讯8

双重突破:全球首个零售VLA大模型来了!开源OpenWBT让机器人遥操门槛暴降!

2025北京智源大会上,银河通用机器人展示端到端具身大模型GroceryVLA,可在商超场景自主操作,具强适用性等五大能力。还发布OpenWBT开源系统,降人形机器人遥操门槛,促产业发展。

量子位
算法论文8

英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限

学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。

机器之心
算法论文7

NICE59期 | Agent进入下一篇章!Alita:不靠人工预设,自己造MCP自我进化的AI

这篇论文提出让 Agent 主动创造解决 MCP 的工具实现自我进化,工具可网上检索或自主编写。Alita 做法更通用实效,还提出‘Agent 蒸馏’思想,其生成的 MCP 已用于‘manus’。

深度学习自然语言处理