「具身操作评测」共找到 2044 篇相关文章
Claude Code 省 Token 指南:慎用 1M 上下文,不开新会话或者总是开新会话都不对
文章聚焦Claude Code省Token问题,分析配额消耗快的原因,介绍提示缓存机制,给出省钱策略、操作规则,还提及委派工作及澄清误解,强调让缓存多命中、上下文少装无关内容。
扣子 2.5,过了体验那条红线
作者参加扣子Coze官方直播后分享使用感受,认为扣子2.5过了体验红线,普通人打开就能用且能解决问题。它继承龙虾优点,封装大模型能力,前端体验顺畅,还有云手机等功能,虽有不足但值得期待。
Anthropic发布Managed Agents,才发现这支硅谷华人团队早就押对了赌注
今早Anthropic发布Managed Agents,强调‘Agent Harness’概念。CREAO由硅谷华人团队打造,作为全球首个面向普通用户的AI Agent Harness,0门槛、高稳定,解决诸多问题,具独家能力,获多轮融资。
黄仁勋对话 10 位开源 AI 掌门人:未来算力将向后训练倾斜,OpenClaw 开启了现代计算机的新想象|GTC 2026
在 GTC 2026 上,黄仁勋与 10 位开源 AI 掌门人探讨开放模型。大家认为 AI 正从模型走向系统,未来算力或向后训练倾斜。OpenClaw 让大众感知到 agent,企业落地难点在治理,开放模型价值体现在可控、定制和信任。
如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程
丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。
5.3K Star!OpenClaw 最强“军火库”,700+ Skills,一条命令全能“武装”!
OpenClaw火遍全网,但裸奔的Agent需技能加持。GitHub上的awesome - openclaw - skills已获5.3K Star,收录700 +实用技能插件,涵盖30 +领域,一行命令就能安装技能,是OpenClaw生态完整的技能索引库。
鹅厂员工都用AI Coding捅过多少篓子?
本文盘点AI Coding翻车现场及防坑指南,10位鹅厂同事分享用AI Coding捅过的篓子和防坑技巧,如选好模型、手动拆解任务、提前备份、限制危险操作等。
刚刚,Cursor分享了他们使用Agent Coding 的最佳实践
Cursor分享了使用Agent Coding的最佳实践。编码Agent正改变软件构建方式,需理解其工作原理并形成新使用范式,文中还介绍了规划、管理上下文、扩展Agent等多方面的操作方法与策略。
Anthropic:大模型开始意识到自己在想什么!
Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。
社区供稿丨AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
清华大学、中国人民大学等联合研发的 AgentCPM-Explore 智能体模型开源,它基于 4B 参数,在深度探索类任务表现佳。有打破参数壁垒等亮点,还开源配套工具,提供应对小模型挑战方法,邀伙伴共建生态。