省Token策略」共找到 1569 篇相关文章

开源动态8

LeRobot v0.5.0 正式发布

LeRobot v0.5.0正式发布,是规模最大的一次发布。在硬件上支持更多机器人,策略模型新增6种,数据集处理优化,还推出EnvHub,代码库也全面升级,此外社区与生态建设也有进展。

Hugging Face
新闻资讯8

Claude 5史诗级泄露,史上最强编程模型评测炸裂!核心秘密曝光

Anthropic的Claude Sonnet 5即将发布,已存在于谷歌基础设施中,性能领先谷歌‘Snow Bunny’一代。它价格比Opus 4.5便宜50%,有100万token上下文窗口,SWE - Bench成绩超80.9%,还有自动开发团队模型。

新智元
新闻资讯7

MCP 或将成弃子

Anthropic工程师发博客‘背刺’自家MCP,提出新方案让token消耗大减。新方案把MCP服务器转成代码文件运行,Skills或成MCP替代品,虽MCP还有价值场景,但多数情况下代码+Skills更优。

AGI Hunt
开源动态7

Glyph:文本转图片解决长上下文困境,智谱把“DeepSeek-OCR”具像化了

传统 token 扩展方式遇算力成本天花板,DeepSeek 与智谱都想到让 AI“看”文字思路。智谱发布 Glyph 框架工程化实现此思路,将文本转图片处理,降低计算成本,有不错效果但也存在排版敏感等限制。

AI工程化
产品应用7

从0到1:天猫AI测试用例生成的实践与突破

本文阐述天猫技术团队在AI赋能测试领域的实践,讲述智能测试用例生成落地路径。介绍业界现状与天猫业务特性,给出实施策略,展示应用效果,还指出问题并对未来发展做了展望。

阿里云开发者
算法论文8

VLA 推理新范式!一致性模型 CEED-VLA 实现四倍加速!

近年来,VLA模型成机器人领域重要研究方向,但推理速度受限。本文提出一致性蒸馏训练、混合标签监督机制及提前退出解码策略,在多基线模型上实现超4倍推理加速,实验验证其高效通用。

机器之心
推荐文章7

Karpathy:我不是要造新词,是「上下文工程」对 Agent 来说太重要了

Andrej Karpathy 认同Shopify CEO关于「上下文工程」的观点。它指为大语言模型提供恰当信息和工具,比提示词工程更重要。文章介绍其概念、与提示词工程区别,及写入、筛选等落地策略

Founder Park
新闻资讯7

把 RAG 做成主流的公司,现在开始“做空”RAG 了

Pinecone 曾将 RAG 定义成大语言模型 grounding 标准范式,如今却宣布 RAG 时代结束。它推出面向 Agent 的知识引擎 Nexus,提出“知识编译”概念,称能提高任务完成率、降低 token 开销,整个 AI 世界都在将“推理”往上游移动。

AI前线
开源动态8

冲159K星 OpenClaw工具链,正在悄悄改变Agent玩法

Clawdbot更名openclaw后在github星冲到159K。它能让AI深入工作流且保数据隐私,有集成渠道多、工具齐全、有状态会话与持久记忆、路由策略适配不同模型等核心能力,并在多方面优于常见AI工具。

CourseAI
8

Anthropic的疯狂一周:每天一个新产品,我已经跟不上了

4月4 - 9日,Anthropic动作不断,先封杀第三方Agent用Claude订阅额度,又发布Claude Mythos Preview、Claude Managed Agents和Advisor Tool。其Agent产品线分三层,还展现“不发布”策略,背后是控制生态的商业考量。

花叔