跨具身学习」共找到 2498 篇相关文章

算法论文8

冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世

微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。

机器之心
新闻资讯8

ChatGPT上瘾,大脑萎缩47%!MIT祭出206页92图超长报告

麻省理工学院完成针对ChatGPT用户的首次大脑扫描研究,发现长期依赖大模型,学习能力下降、大脑受损,神经连接减少47%。AI提高效率或为误解,使用它是用长期思维能力换短暂效率。

新智元
推荐文章8

北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工使用及未来研究方向。

Founder Park
新闻资讯8

2026「中国 AGI 创新影响力机构 TOP 30」发布

过去一年 AI 行业变化溢出模型层,Coding Agent 铺开,视频生成实现商业变现,身智能供应链成型。Founder Park 从四维度选出「中国 AGI 创新影响力机构 TOP 30」,涵盖多领域团队。

Founder Park
新闻资讯8

Figure机器人直播100小时打擂台,3秒一个不停分拣13万包裹!

Figure公司F.03机器人直播分拣包裹超100小时,分拣超13万个。10小时人机对决中,人类以不到200个包裹险胜。CEO称这是人类最后一次赢,身智能飞轮或已过拐点。

新智元
推荐文章7

为什么你的 AI Agent 总是用不起来?答案在 Skills

文章围绕AI Agent的Skills展开,介绍其范式价值,如从“单一智能”到“模块化智能”;还提及知识沉淀、平台能力迁移等作用,以及对人机关系、人力市场与劳动结构的影响。

AIGC开放社区
算法论文8

仅需10%思维链标注,等同全量性能!中科院发布推理监督新范式

中科院计算所团队提出新框架PARO,让模型学习固定推理模式自动生成思维链,只需标注1/10数据就能达全量人工标注性能,适合规则清晰领域,为推理监督提供新思路。

新智元
算法论文8

让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器

当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创新强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型。

机器之心
产品应用8

实测谷歌AI故事书,我实现漫画和绘本自由了

谷歌Gemini推出免费StoryBook工,30秒左右可生成10页故事书,支持中文且内容有趣。测试显示,它在图像风格、故事创作上表现出色,还能作学习和展示工,获网友好评。

量子位
新闻资讯8

「部署态」元年,这家公司就把落地方案卷到了七种

在4月17日上海举办的大会上,智元拿出四大全新机器人产品、六大AI模型、七大标准化生产力解决方案及全栈生态技术体系。其创始人认为身智能正从“开发态”向“部署态”进化,2026年是元年。

机器之心