零Token部署」共找到 1617 篇相关文章

新闻资讯8

Demo秀终结,机器人连干8小时不歇!智元定义「部署态」

4月17日智元合作伙伴大会上,智元创始人定义2026为「部署态」元年,即机器人在真实场景7×24小时自主干活。大会首提XYZ曲线产业发展框架,还发布七大生产力解决方案,展示四大新本体、六大AI模型等成果。

新智元
算法论文7

原来Scaling Law还能被优化?Meta这招省token又提效

2017年《Attention Is All You Need》提出的Transformer是主流语言模型基础范式。Meta新论文提出旋转不变型三线性注意力机制,证明其表现能改变Scaling Law系数,还证实2 - simplicial Transformer在有限token预算下更优。

机器之心
算法论文8

基于文本AI的终结?Agent协作可直接「复制思维」,Token效率暴涨

在 Agentic AI 时代,多智能体系统让 AI 从单打独斗变为团队协作。普林斯顿大学等机构研究者提出多智能体推理框架 LatentMAS,将协作从 token 空间转移到潜在空间,实验显示其性能、效率大幅提升。

机器之心
产品应用8

Claude上线Prompt缓存诊断功能,终于不用盲猜token成本暴涨的原因

Claude宣布Prompt缓存诊断功能登陆控制台,可解决缓存失效排查痛点。此前开发者排查效率低,新功能能显示变动位置与token损耗。目前处于beta阶段,介绍了使用方法、支持的失效原因及功能限制等。

AI工程化
推荐文章8

Token纪元:从「马力」到「人天」再到「兆字元时」的认知革命

文章指出,AI时代需全新生产力计量单位“马斯”。字元是AI“语言燃料”,但缺乏统一计量体系。智能社会的容量、速度、价格是关键指标,当前AI算力网络停在2G时代,AI劳动力崛起将重构就业,Token或引发文明跃迁。

InfoQ
算法论文8

Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升

当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。

PaperAgent
开源动态8

Rust 版 OpenClaw 来了!单文件、依赖、强沙箱、自带“故障转移”!

Rust版OpenClaw——Moltis问世。其依赖、全沙箱、反泄露,以Rust架构带来多好处,还统一模型接口,支持本地模型离线运行,安全和存储机制出色,是面向生产的Agent框架。

开源星探
算法论文8

SPIRAL:和游戏自对弈成为语言模型推理训练的「免费午餐」

新加坡国立大学等机构团队提出 SPIRAL,让模型在和游戏自对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。

机器之心
产品应用7

5万人抢光「阶跃龙虾」:3分钟一键部署,「养虾」终于变简单了

3月12日「阶跃龙虾」上线,提供5万个免费体验名额。此前阶跃星辰自研的Step 3.5 Flash模型在OpenRouter平台霸榜。其一键部署功能简化养虾流程,且云端版本支持7×24小时在线,国产厂商正推动AI Agent使用范式转变。

机器之心
新闻资讯7

Claude凭空造假强行部署,比黑客更可怕的入侵者!Vercel CEO紧急预警

Vercel CEO曝光一起AI安全事件,基于Claude Opus 4.6的AI编程智能体凭空编造GitHub仓库ID,将学生作业部署到企业环境。这揭示AI失效模式与人类迥异,还引出包幻觉攻击风险,同时提到OpenAI秘密开发代码平台。

新智元