研究智能体」共找到 5005 篇相关文章

推荐文章8

当机器人走进个人生活,我们为什么需要它?|甲子光年智库

甲子光年智库发布《2026个人机器人应用价值研究报告》,分析个人机器人产业从技术演示迈向真实家庭场景的新阶段,梳理行业玩家路径,探讨产业核心方向与未来增长空间。

甲子光年
新闻资讯8

NVIDIA 李柏依:机器人只会「看」还不够,它还得学会「听」| ECCV 2026

本文整理了NVIDIA Research科学家李柏依在ECCV 2026 Workshop的分享,针对机器人训练数据采集壁垒高的问题,介绍了两项解决多模态感知与灵巧操作数据难题的前沿研究

AI科技评论
开源动态7

开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval

8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合多机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型。

机器之心
推荐文章7

「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解

AI编程圈两极分化,围绕底层Harness是否消失争议不断。前Kimi CLI负责人stdrc提出反常识观点,认为模型越强Harness越厚,复杂度从“能力层”转移到“协作层”,还以Kimi CLI实践及Raft创业为例阐述。

AI科技评论
新闻资讯8

手握1000项专利的“药物狂人”,为何在AI制药时代选择逆行?

手握约1000项专利的再生元联合创始人乔治·扬科普洛斯,在AI制药成热点时选择逆行,坚持内部研发、人类遗传学和基础生物学。他批评跟风,强调深入理解疾病机制,认为AI可增效但不能决定方向。

DeepTech深科技
算法论文8

GPT-5.4 仅 11.36%!当大规模工具生态变成迷宫,LLM Agent 还能完成长程规划吗?

PlanBench-XL 来自 UIUC 团队,将 LLM Agent 放入零售 API 世界,评测其长程规划能力。它考虑真实工具环境挑战,含 327 个任务等,发现多数模型规划难、恢复差等问题,并给出改进启示。

深度学习自然语言处理
开源动态8

开源不到一天1.9k星星!NVIDIA新突破,机器人ChatGPT时刻!

NVIDIA开源ProtoMotions3框架,用经典自回归预测和物理仿真,让高级行为涌现。它能助力机器人多方面学习,有望降低人形机器人开发门槛,虽处研究阶段,但提出新思路。

GitHubStore
算法论文8

让机器人学会“预判接触”:它石智航牵头四大顶尖机构发布TacForeSight,破解精细操作难题

它石智航联合四大顶尖机构发布论文“TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation”,提出力条件触觉世界模型,让机器人能提前预判接触变化,在精细操作领域取得关键进展。

量子位
算法论文8

GAIR Paper 106|追踪视觉 Token 的演化轨迹,实现无损压缩与 60% 推理加速|CVPR 2026

近年来大视觉语言模型虽推动多模态智能发展,但推理成本高昂。山东大学和MBZUAI团队提出TransPrune,从演化视角衡量视觉Token重要性,保持性能无损同时降低60%推理成本。

AI科技评论
算法论文8

0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了

SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺全局系统规划能力,引发对其评估方式的讨论。

机器之心