「人类移动行为」共找到 1489 篇相关文章
RLinf上新πRL:在线强化学习微调π0和π0.5
近年来,基于流匹配的VLA模型成机器人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。
马斯克、奥特曼X上再开撕,Ilya最新52页证词曝光,抖出OpenAI更多内幕
马斯克、奥特曼又在 X 上开撕,奥特曼因 Tesla Roadster 退款问题与马斯克起争执,马斯克旧事重提指责奥特曼偷非营利组织。同时,Ilya 52 页证词曝光,抖出 Sam Altman 被解雇内幕、备忘录依赖二手信息等 OpenAI 更多内幕。
首个实例理解3D重建模型!NTU&阶越提出基于实例解耦的3D重建模型,助理场景理解
人类能自然感知3D世界的几何与语义,但AI做到“两者兼得”是挑战。NTU联合StepFun提出IGGT,将空间重建与实例级上下文理解融为一体,还构建了InsScene - 15K数据集,解决了传统方法的问题。
RecGPT-阿里的LLM推荐系统落地方案
文章介绍阿里RecGPT推荐系统落地方案,包括召回和推荐可解释性两方向。召回采用三塔结构,通过挖掘用户兴趣生成商品标签提升召回多样性。还提及行为序列压缩、推荐归因等,以及大模型微调和评估方法。
提效软件研发,AI Agent好用吗?
InfoQ直播邀请多位专家探讨AI4SE,提及前端知识库特点、Agent自学习等。专家认为AI目前多辅助人类,落地要重视“人”因素,还探讨了应用挑战、衡量维度、未来趋势等,QCon上海站将设专题。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。
他,37岁华裔,靠AI成为福布斯400最年轻亿万富翁,身价180亿美金!
37岁华裔Edwin Chen成《福布斯400》最年轻亿万富翁,身价180亿美元。他拒绝VC融资,用积蓄打造估值300亿美元的AI数据标注公司Surge,希望让AI学会「人类的复杂性」,还担忧AI模型被错误优化。
让图像生成告别 AI 味!清华 + 港中大 + 腾讯混元联手推出SRPO
腾讯混元联合港中大、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美等,训练时间缩至十分钟,在测试中碾压主流方法,不过对冷门风格控制和机制可解释性待提升。
21岁MIT辍学,估值3亿美金!誓要自动化十亿小时办公
两个MIT辍学生创办AI合规初创公司Delve,成立半年获3200万美元融资,估值达3亿美元。他们用AI智能体解决企业合规痛点,目标是自动化十亿小时人类办公,虽有竞争,但凭借领域深度脱颖而出。
波士顿动力 | 人形机器人Atlas ,最新研究进展!
世界人形机器人运动会引发对自主机器人的讨论。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型(LBM),使其能自主完成复杂任务,研究团队展示成果并介绍模型构建流程、实践成果及研发原则。