自训练」共找到 3003 篇相关文章

算法论文8

碾压π0.5,复旦团队首创「世界模型+具身训练+强化学习」闭环框架

复旦团队针对当前 VLA 策略依赖模仿学习、真实机器人在线 RL 成本高、传统物理仿真器有局限等问题,提出 ProphRL 框架。该框架以世界模型 Prophet 为核心,结合 RL 算法,为具身智能落地提供更可行路径,实验效果显著。

机器之心
新闻资讯7

他为500强造出冠军「AI裁员机器」!然后,把己裁掉了

Donald King在普华永道为500强客户打造AI智能体,刚获OpenAI黑客松比赛第一名,2小时后就被裁。他创业成立AI营销机构,称被裁是好事,还建议失业者扩展人际网络。

新智元
算法论文8

适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出多模式适应路由,实现模式适应切换,在多基准测试中效果与效率双升。

深度学习自然语言处理
新闻资讯8

西湖大学打造了一个AI科学家,突破人类SOTA,还能己发论文

西湖大学文本智能实验室推出能主探索的AI科学家DeepScientist,两周完成人类三年科研量。它在三个前沿AI任务刷新SOTA纪录,还能写论文。文中介绍其科研历史、工作方式、成果及面临的伦理问题。

AIGC开放社区
新闻资讯8

谷歌发布AP2协议,联手PayPal放大招:AI要己下单了

2025年9月17日,谷歌推出智能体支付协议AP2并开源,宣布与PayPal战略合作。AP2通过‘授权令牌’解决AI下单信任问题,设计三种场景令牌,还采用角色架构保证安全,谷歌联合超60方搭建生态。

AIGC开放社区
算法论文8

突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法

AI Agent处理复杂任务时显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。

量子位
7

AI越来越强大,如果客户都去研了,那企业软件市场会怎么样?

AI能力变强、门槛降低,引发企业软件开发是否会被颠覆的讨论。企业不会建核心系统,因要专注核心业务且不想承担维护等成本。真正威胁是用AI重新设计产品的同行,技术更替规律下传统SaaS公司需警惕。

AI工程化
新闻资讯8

DeepMind掌门曝AGI倒计时5年!算力需求暴增10倍,推理计算吞噬一切

在最新播客中,DeepMind掌门Hassabis表示然界规律能被机器学习算法模仿。他畅想AGI应用于游戏,还提及迈向AGI要扩大计算规模,算力需求或增10倍,且运营上以初创公司模式兼顾研究与产品。

新智元
新闻资讯7

AI训练?OpenAI研究员Jason Wei泼冷水:它的三大瓶颈你根本想不到

OpenAI研究员Jason Wei认为AI我完善是未来趋势,但不会‘瞬间爆发’,而是漫长过程。他从三方面阐述,包括我完善非一蹴而就、不同领域完善难度有差异、科学进步受真实世界实验限制。

AI寒武纪
算法论文7

LLM已能我更新权重,适应、知识整合能力大幅提升,AI醒了?

近期,AI我演进话题研究讨论渐热。OpenAI奥特曼畅想AI我改进未来,有爆料称其内部运行递归式我改进AI。MIT论文提出SEAL框架让LLM我更新权重,引发热议,实验显示其有提升但也有局限。

机器之心