「智能体强化学习」共找到 4611 篇相关文章

产品应用7

我拿到了豆包 AI 手机,但它已被围剿

作者拿到豆包AI手机时,它已被部分产品禁止使用。此为面向行业和技术爱好者的技术预览版,内置AI Agent可像人一样操作手机,还介绍了功能、架构等,但推广因App墙受限。

MacTalk
算法论文8

为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?

伊利诺伊大学香槟分校等多校合作研究发现,当前机器人学习主流的多传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。

机器之心
推荐文章8

Scaling 时代落幕:Ilya 眼中下一代 AI 的关键,不在模型,在人类

深度学习亲历者 Ilya Sutskever 认为单靠扩大模型规模推进 AI 的时代已结束,未来关键在于解决 AI 泛化难题。他指出当前模型评测与现实能力脱节,人类泛化能力强或源于进化,还探讨了价值函数等内容。

InfoQ
算法论文8

自适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出多模式自适应路由,实现模式自适应切换,在多基准测试中效果与效率双升。

深度学习自然语言处理
算法论文8

LSTM之父Jürgen再突破,「赫胥黎-哥德尔机」让AI学会自己进化

LSTM 之父 Jürgen Schmidhuber 对 2003 年提出的哥德尔模型进行新尝试,构建赫胥黎 - 哥德尔机(HGM)。它能在 SWE - Bench Lite 媲美最佳人类设计智能体,还在多基准测试中超越现有方法,展现强大迁移能力。

机器之心
新闻资讯7

AI原生产品不等于全部功能AI化,保留传统功能让用户体验更完整 | 对话小卡健康

AI健康管理赛道竞争激烈,产品各有差异。量子位智库访谈小卡健康产品负责人李雅,探讨AI如何赋能、产品功能拓展、数据指标关注、智能设备联动、开发问题及运营推广等,展示其差异化策略和发展思考。

量子位
新闻资讯7

讲座分享 | 密歇根大学Karthik Duraisamy教授

密歇根大学Karthik Duraisamy教授将开展讲座,主题为数据驱动的湍流建模。会介绍过去十年嵌入学习模型增强的进展,强调简约与约束平衡,指出存在的陷阱及挑战,还提及让数据驱动封闭成为可靠组件的要点。

力学与人工智能
算法论文8

加速近5倍!北大与字节团队提出BranchGRPO,用「树形分叉 + 剪枝」重塑扩散模型对齐

北京大学与字节团队提出 BranchGRPO 新型树形强化学习方法,通过在扩散反演中引入分叉与剪枝,解决扩散/流匹配模型人类偏好对齐难题。该方法在图像与视频生成任务中表现优异,迭代时间最高近 5 倍加速。

机器之心
7

你可能没注意,腾讯已经把 AI 融进了这两个关键场景

作者参加腾讯全球数字生态大会AI协同办公与组织升级专场,关注腾讯乐享AI知识库和腾讯电子签合同智能引擎。乐享解决传统知识库痛点,让知识融入工作流;电子签实现合同管理全流程智能化,解放法务劳动力。

MacTalk
新闻资讯8

奥特曼爆料:GPT-5重构彻底一切!一人顶五个团队

GPT-5的发布或是一场技术变革。奥特曼在对谈中给出未来清单,谈到年轻人学习方向、创业思路等。他认为GPT-5是大飞跃,年轻人要掌握AI工具,还提出评估大模型智力新指标等。

新智元