「机器人策略评估」共找到 2382 篇相关文章
Shopify 经验贴:如何搞出一个生产级别可用的 AI Agent 系统?
Shopify 以 AI 助手 Sidekick 为例,分享从简单工具调用系统演变为复杂 AI Agent 平台的经验,包括架构设计、评估方法和训练技术等方面,还给出构建生产级别可用的 AI Agent 系统的四条核心建议。
EmbodiChain开源,用100%生成式数据自动训练具身智能模型
跨维智能开源EmbodiChain,它是通往GS - World的基石,重构具身智能学习范式。其以100%生成式仿真数据训练机器人,突破数据瓶颈,还对比了不同路线,测试显示其模型效果佳。
MemOS:一种用于 AI 应用的记忆操作系统
大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。
谷歌 Apigee 添加了内置的 LLM 治理 Model Armor
谷歌云推出 Model Armor 公开预览版,这是集成到 Apigee API 管理平台的 LLM 治理框架。它能执行特定策略,检测多种风险,支持多 LLM 提供商,还与 GKE 和 Security Command Center 集成。
图文跨模态“近视”问题破局:360开源新模型 FG-CLIP,实现细粒度图文对齐突破|ICML2025
360人工智能研究院发布 FG - CLIP 模型,攻克图文细粒度对齐难题,成果被 ICML 2025 接收并开源。它采用双阶段训练等策略,在多任务评测中超越对比模型,推动跨模态研究产业化落地。
库克不忍了!挥刀优化苹果AI大总管
苹果官宣AI负责人John Giannandrea卸任,其领导下苹果AI团队落后同行,新版Siri推迟发布。同时,苹果从微软挖来Amar Subramanya出任AI副总裁。此外,苹果机器人技术负责人Yilun Chen跳槽特斯拉,军心涣散。
Anthropic:怎么才能控制模型的行为,做好Agents?
Anthropic发关于AI Agents博客,围绕如何配置上下文让模型输出期望行为展开。指出上下文是有限资源,有Context Rot现象,介绍了上下文工程概念、构成,还提及即时策略、长时间任务处理方法及实践建议。
关于Pingpong和Cooperative的一些感性理解
作者团队在SGLang支持Hopper架构相关GEMM,经分析发现多数场景Pingpong调度策略性能优于Cooperative,K维度小的场景DeepGEMM性能优于CUTLASS。本文重点介绍Pingpong性能优势及Cooperative无法Overlap Epilogue的原因。
会解题不等于懂人心,腾讯混元提出Sentient Agent,提高高阶社交认知能力
过去评判LLM像考核‘做题家’,但会解题不等于懂人心。腾讯团队提出SAGE框架,用会闹情绪的agent评委评估模型高阶社交认知能力。实验显示不同模型表现差异大,未来需懂人心的AI。
鹅厂员工怎么看Agent自动持续进化?
落地一个Agent容易,但让其自动持续优化很难。文章分享了9位鹅厂同事对“Agent如何自动持续进化”的看法,如建立评估体系、记录真实任务反馈、结合强化学习等。