「具身基础模型」共找到 8378 篇相关文章
对话付昊桓:数值模拟不能被替代,AI 应该放在哪里丨GAIR 2025
在GAIR 2025大会上,付昊桓教授结合地球系统模型与超算实践,探讨数值模拟与AI的边界和可能。他认为数值模拟是基础,AI可补充,二者应深度融合,还谈及气象领域商业价值和未来期待。
ECCV 2026 | 一段视频,重建一个可仿真的动态世界
机器人走出实验室后,训练数据需覆盖真实世界情况。OVOW由多团队完成,被ECCV 2026接收。它从单目视频出发,输出可编辑、可碰撞的实例级Mesh,串联视觉基础模型完成流水线工作,能用于物理仿真。
仅用提示词工程摘下IMO金牌!清华校友强强联手新发现,学术界不靠砸钱也能比肩大厂
清华校友杨林和黄溢辰,仅用提示词设计和自我迭代验证流程,让基础模型Gemini 2.5 Pro达到IMO金牌水平。他们设计的流程分六个步骤,用差异化提示词,最终为5道题生成严谨解答。
开源音视频同步SOTA基座:极简的单流架构,2秒出片
AI视频生成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频生成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上生成精准音视频同步画面。
别让米其林主厨削土豆!英伟达用「小脑指挥大脑」,重构AGI生产力
英伟达推出8B模型Orchestrator,通过组合工具降本增效。在HLE等测试中超越GPT - 5,成本仅为其30%左右。它还能泛化到未见工具,具有可定制调度能力,标志着复合AI新范式的兴起。
半在线RL新范式UI-S1,使得GUI Agent既稳定又规划长远
现有AI训练方法在GUI自动化中各有弊端,本文提出半在线强化学习范式,训练出UI - S1 - 7B模型,性能提升显著,还提出新评估指标SOP,是迈向实用化AI智能体的重要一步。
DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体,训练量暴增10倍
DeepSeek正式上线DeepSeek-V3.1,作为首款「混合推理」模型,将开启智能体新时代。它参数共671B,具强大智能体能力,编程击败Claude 4,训练量大幅扩增,在多方面测试表现出色,稳坐编程开源第一王座。
极佳视界获新一轮亿元级 A1 轮融资,CEO:“物理世界 ChatGPT 时刻”将在 2 至 3 年内到来
近日,极佳视界完成新一轮亿元级 A1 轮融资,由华为哈勃、华控基金联合投资。该公司聚焦物理 AI,其创始人兼 CEO 黄冠博士称‘物理世界 ChatGPT 时刻’2 至 3 年内到来,世界模型技术价值已现。
从豆包手机谈起:端侧智能的愿景与路线图
近日,字节跳动发布豆包手机助手,标志大模型应用从‘Chat’迈向‘Action’。文章解析其关键技术,指出虽具实用价值,但端侧智能体面临安全、自主任务、个性化服务等挑战,还展望了手机助手与端侧智能体的未来发展。
智能体新范式Chain-of-Agents,多项任务新SOTA
论文提出Chain-of-Agents (CoA) 范式,结合多智能体系统与工具集成推理优势。通过多智能体蒸馏和智能体强化学习训练智能体基础模型(AFM),实验显示其在Web和Code任务上达新SOTA,效率、泛化性佳。