「工程基础设施」共找到 1071 篇相关文章
大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!
Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。
Current Robotics 发布 Curr-0:以 Single Policy 实现全身灵巧操作
Current Robotics发布Curr - 0,解决人形机器人移动与操作分离困境。它用Single Policy统一训练,基于HumanEx采集数据,还构建多物理模态交互世界模型,是全栈具身智能基础设施成果。
国产GPU开始造世界!国内首个全栈具身智能仿真平台来了
摩尔线程发布国内首个全栈国产化具身智能仿真平台MT Lambda,实现Sim-to-Real真机验证。该平台像物理AI训练流水线,集成物理、渲染、AI引擎。其依托全功能GPU和MUSA架构,还构建了云端、端侧、生态闭环。
重生之我在AI时代当老板:让一群Agent互相PUA
MiniMax推出新Agent Mavis,可组建团队完成任务。其Agent Team分工明确,能解决单Agent在长程任务中的痛点,还将开源。此外,TokenPlan和Agent Plan合并,性价比提升。
超150位全球AI一线技术专家齐聚巴黎,这场大会到底聊了些什么?|GOSIM Paris 2026圆满收官
5月6日,GOSIM Paris 2026进入第三天,议程转向技术实践。超150位全球AI专家齐聚,探讨模型推理优化、开源社区治理等。Niko Matsakis等分享前沿观点,还有五大主题论坛及工作坊,展示开源AI生态成果。
独家|前蔚来AI平台负责人白宇利创立「补天石科技」,聚焦具身数据 Infra 方向
前蔚来AI平台负责人白宇利创立上海补天石科技,聚焦具身数据Infra方向。该公司为机器人模型训练提供高效工程体系,首轮融资由红杉领投,团队正处早期组建阶段。
Agent不是关键!人大AiScientist实现23小时、74轮长程记忆
中国人民大学团队打造的AiScientist,旨在解决长程机器学习研究工程的持续性难题。它通过File - as - Bus机制稳定保存项目状态,在多轮实验中表现出色,提升科研效率,推动AI真正接手科研流程。
π0.6和GEN-1谁代表未来?乾坤未定,但这条底层赛道浮出水面
Generalist AI的GEN - 1引发行业关注,其创始人验证具身智能尺度定律。但很多公司在数据质量上遇困。智域基石提出‘数据编译’概念,构建五层编译管线,有独特商业模式,对未来数据路线持‘路线中立’观点。
训练提速4.6倍!FP4+BF16双轨并行,NVIDIA×港大×MIT联手重新定义扩散模型训练速度上限
NVIDIA、港大、MIT团队提出Sol - RL,采用「FP4先探索、BF16再训练」框架,将扩散模型训练收敛速度最高提至4.64x,在速度与对齐效果间给出工程可行解法。
Anthropic 的 Harness 哲学:把 Agent 当牲口,而非宠物
本文分享Anthropic最新两篇博客,介绍其将运维圈“宠物 vs 牲口”哲学用于AI Agent架构设计。旧架构如“宠物”易出问题,新架构脑手分离,把Harness做成可随时重启的“牲口”,降低延迟、提升安全,还提出信任框架。