任务级奖励」共找到 2957 篇相关文章

开源动态8

腾讯发布混元3D世界模型1.0:首个支持物理仿真的开源世界生成系统

在2025年世界人工智能大会上,腾讯发布混元3D世界模型1.0,它是首个开源且兼容传统CG管线的可漫游世界生成模型。可通过文图生成3D世界,支持编辑、仿真,有360°沉浸、工业兼容、原子交互优势。

量子位
推荐文章7

AI领域并无真正的新想法,只有新的数据集

作者Jack Morris认为AI虽进步明显,但范式转变突破不多。大语言模型四次关键突破底层理论早已有之,新在于数据。改变数据比调整模型或算法作用更明显,推动AI进步应找新数据,如YouTube或具身化数据。

宝玉AI
算法论文8

AI哪怕答案正确,逻辑链却惨不忍睹,奥数不等式证明成功率不到50%| 斯坦福&伯克利&MIT

斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数不等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。

量子位
产品应用8

跑通AI Agent「最后一公里」:iMeanAI的WebAgent后训练技术全解析

文章深入解析iMeanAI的WebAgent后训练技术,指出当前AI Agent落地存在从‘理解’到‘执行’的困境。通过两个极限任务展示其能力,介绍核心技术架构和后训练进化引擎,还提及该技术带来的自由体验,其1.0版本已公测。

AGI Hunt
算法论文8

谢赛宁团队新基准让LLM集体自闭,DeepSeek R1、Gemini 2.5 Pro都是零分

纽约大学等8家机构研究者提出LiveCodeBench Pro竞技编程基准测试,评估了Gemini 2.5 Pro等前沿大模型。发现当前模型有显著不足,在无外部工具时,高难度题通过率为0,LLM与人类大师水平差距明显。

机器之心
算法论文8

沉迷贪吃蛇,7B小模型竟变身「数学天才」!几何推理碾压GPT-4o

NVIDIA等团队提出视觉游戏学习ViGaL范式,让7B多模态模型玩贪吃蛇等游戏,使其在数学、几何等任务击败GPT - 4o。游戏培养通用认知与推理能力,不同游戏提升不同推理能力,多游戏训练效果更佳。

新智元
产品应用8

波士顿动力机器人进厂打工现逆天操作!3D感知+实时追踪,人类捣乱完全不带怕的

波士顿动力的Altas机器人重磅升,具备3D空间感知和实时物体追踪能力,可自主执行复杂工业任务。文章还解析其背后技术,包括2D感知、3D感知、物体位姿估计和校准等,团队未来将构建统一基础模型。

量子位
新闻资讯7

ChatGPT 评估员工绩效,评得是真能力吗?

绩效考核季,不少管理者用 ChatGPT 生成绩效评语,认为高效。但文章指出,把关键管理工作交 AI 是‘职业肌肉’萎缩,还给出管理场景下 AI 使用清单,网友也对 AI 辅助绩效评估展开热议。

AI科技大本营
新闻资讯7

独家对话希捷科技Jason Feist:AI时代,企业正在“删除删除键”|甲子光年

本文是「甲子光年」对希捷科技云存储业务高副总裁杰森·费斯特的独家对话。费斯特指出,AI 基础设施正从计算、内存转向存储,企业倾向长期保存数据,高容量硬盘重要性凸显。他还探讨了存储系统变化、技术创新等问题。

甲子光年
算法论文8

能效翻5倍!他们复刻人脑双记忆通路,造出能长效记住上下文的类脑AI芯片

帝国理工学院博士后孙鹏飞和苏黎世联邦理工博士后苏哲及合作者,受大脑皮层机制启发,打造“双重记忆路径”类脑网络及配套芯片,处理语音识别任务时能效比此前优方案高5倍。相关论文发表在《自然·机器智能》且代码、设计全开源。

DeepTech深科技