「通用机器人策略」共找到 2334 篇相关文章
同一个模型,换套框架成绩差27%:SWE-bench分数到底谁说了算?
编程Agent评测是笔糊涂账,SWE - bench虽成事实标准,但分数不适合直接横向比较。基元律动等机构发布Claw - SWE - Bench基准,将模型、harness和任务集拆分,通过实验揭示harness对成绩影响大,还解决通用Agent评测问题,推出低成本Lite版。
年入6亿、日本细分赛道第一,国产AI 硬件如何拿下日本智能家居市场?
国产 AI 硬件 SwitchBot 拿下日本智能家居市场市占第一。它单价低、安装灵活,以“非入侵式后装”理念,从智能开关拓展到多品类。2023 年扫地机器人 K10+ 大获成功,后又用 S10 试水美国市场,还推出 K20+ Pro 拓展场景。
大模型竞赛转向:决胜关键为何是“后训练”?
大模型价值主战场正向后训练转移。xAI发布的Grok 4通过后训练取得强大性能,在多项测试中领先。后训练可解决通用模型产业落地难题,不同公司探索新方法,且后训练有五大关键要素,阿里云提供一体化支撑。
vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼
vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。
发生在CES的六场对话:来自深圳的 AI 硬件“外卷”
2026年CES上,中国硬件力量涌向全球。虽有地缘政治摩擦、签证障碍,但全球市场仍看好中国AI硬件。大厂将边缘硬件定义为AI生态入口,初创公司从数据、场景、交互寻生存之道,机器人应用场景也更明确。
一篇多模态大模型推理技术最新综述
华东师大&字节跳动系统回顾基于强化学习的MLLMs推理进展,涵盖关键算法设计、奖励机制创新及实际应用,探讨了RL在LLMs/MLLMs中的关键设计与优化策略,还涉及多模态大模型推理多方面内容。
AI Agent 记忆系统:从短期到长期的技术架构与实践
随着 AI Agent 应用发展,记忆系统成为构建实用 AI Agent 系统的关键技术。文章介绍了记忆基础概念、Agent 框架集成记忆系统的架构,阐述了短期记忆的上下文工程策略和长期记忆技术架构及集成,还分析了行业趋势与产品对比。
PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃
快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化学习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数学推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。
特斯拉造出终结者之手!马斯克要挣1000000000000美元
特斯拉股东大会通过近万亿美元高管薪酬方案,马斯克若10年内让市值达8.5万亿美元等,可获奖励。会上展示人形机器人,其明年量产。此外,FSD技术优,还在研发AI芯片,虽有反对声,但股东多相信马斯克。
AAAI 2026|AP2O-Coder 让大模型拥有「错题本」,像人类一样按题型高效刷题
在AI辅助Coding技术发展背景下,开源大语言模型生成代码有运行错误。上交博士团队提出AP2O方法,构建AP2O - Coder框架,借鉴人类学习模式,经实验验证能提升模型性能、抑制错误、提高样本效率,还适配通用模型。