强化学习范式」共找到 2266 篇相关文章

新闻资讯7

月薪 3500 的 “机器人保姆” 来了!OpenAI 投资的家用人形机器人开售,AI 是核心驱动力

10月28日,OpenAI投资的1X Technologies推出的家用人形机器人NEO开售,早鸟价20000美元/台,也可月租。它硬件出色、AI驱动,能对话、处理家务并持续学习,核心是升级的硬件平台。

InfoQ
产品应用8

1B 参数跑出 2B 性能?面壁 MiniCPM5-1B 用 AI 自进化,提速 AGI 进程

全球AI行业陷入资源消耗战,面壁智能绕开物理瓶颈,提出“AI制造AI”路径。2026年5月25日发布MiniCPM5-1B,有越级性能、极致压缩比和均衡能力,源于“模型、框架、数据”自进化范式

AI科技评论
新闻资讯7

56岁在英国读博一:你看待世界的视角代表你内心盛开的花朵

英国Bristol大学胡老师分享56岁大叔博士答辩考核体验。大叔工作扎实、演讲强,年轻时因条件搁置读博梦,现子女毕业有积蓄便追梦。作者对此事有诸多感触,还提及AI学习市场。

Agent的潜意识
开源动态8

开源不到一天1.9k星星!NVIDIA新突破,机器人ChatGPT时刻!

NVIDIA开源ProtoMotions3框架,用经典自回归预测和物理仿真,让高级行为涌现。它能助力机器人多方面学习,有望降低人形机器人开发门槛,虽处研究阶段,但提出新思路。

GitHubStore
新闻资讯7

OpenAI内部大重组!模型行为团队并入Post Training,负责人另起炉灶

OpenAI对模型行为团队重组,其创始负责人Joanne Jang组建OAI Labs,探索人与AI协作新范式。模型行为团队约14人并入Post Training,OpenAI还完成系列人事调整。

量子位
算法论文8

Meta华人实习生搞出超级智能体!自己写代码实现自我进化

Meta研究团队论文结合哥德尔机思想与达尔文开放算法,提出达尔文哥德尔机,进而定义超级智能体Hyperagents。它能持续自我迭代,实现元学习,实验证明其能有效自我提升,且改进有迁移性。

量子位
算法论文8

华为发布业界首个扩散语言模型Agent,部分场景提速8倍!

华为等团队研究发现,把Agent“底座”换成扩散式大模型(DLLM),执行速度提升30%以上,部分复杂任务效率达传统AR模型8倍。其优势源于生成范式,可重塑Agent设计。

量子位
产品应用8

1人顶1个Infra团队!OpenAI前CTO新招,让大模型训练跌成白菜价

大模型训练正从‘作坊炼丹’进化为‘工业微调’。OpenAI前CTO创立的Thinking Machines Lab推出Tinker,潞晨云微调SDK兼容其范式,实现算法设计与基础设施解耦,降低成本,提升人效,适用于多场景。

新智元
开源动态7

开源沉浸式「AI 教师工具」,学生还上什么补习班?

介绍开源项目ChatTutor,它是面向理工科的智能可视化教学助手,结合对话式AI与多类型可视化知识画布,能图文并茂讲解知识点,让复杂知识图形化呈现,提升学习效率,有望推动AI教育落地。

开源AI项目落地
算法论文8

2篇最新论文,把Deep Research讲透了~

阿里开源Tongyi DeepResearch热度高,文章分享两篇相关技术综述。介绍Deep Research是代理研究新范式,阐述其四大核心模块、优化方法、数据处理、奖励机制,还提及开源系统亮点及相关论文。

PaperAgent