「Physical Token经济学」共找到 685 篇相关文章
把 RAG 做成主流的公司,现在开始“做空”RAG 了
向量数据库开创者 Pinecone 宣布 RAG 时代结束,推出面向 Agent 的知识引擎 Nexus。它认为当前 RAG 模式脆弱、缓慢且昂贵,提出“知识编译”概念,称能提升任务完成率、降低 token 开销,虽面临质疑,但方向明显。
两小时激辩:黄仁勋为什么不怕 TPU、不怕华为、不怕出口管制?
黄仁勋接受长达两小时专访,谈及Nvidia使命、经营哲学等多方面。他认为能源政策制约未来,CUDA优势在于生态等,还谈了对TPU、出口管制等看法,不过其观点存在矛盾待检验。
慧荣科技苟嘉章:AI大厂重塑存储需求基本盘
在CFMS |MemoryS 2026峰会上,慧荣科技总经理苟嘉章指出AI大厂重塑存储需求,苹果排名下滑。慧荣科技展示多领域产品,推出主控芯片,在技术路线上有取舍,还谈到“Physical AI”及端侧分工。
阿里云飞天企业版X平头哥“真武”芯片,推理性能跃迁13倍,底层逻辑是什么?| Q推荐
过去几年,模型虽强但使用成本高,阻碍企业级AI深度应用。今年‘模型推理’成AI关键词,4月13日19:00,InfoQ联合阿里云邀专家围绕推理加速底层破局展开对话,探讨算力博弈、芯片性能跃迁等问题。
Claude Code一周份额,一天就烧完一半?有人逆向工程发现了7个bug
Claude Code在快速更新中问题频发,如思考深度大幅下降,还存在7个叠加的bug,浪费用户token配额。开发者给出应对建议,新版本增加账单透明度和缓存过期提醒,该工具正面临信任危机。
硅谷直击:黄仁勋入局龙虾大战,宣告 SaaS 已死,推理算力需求暴涨万倍!
本文为 CSDN 对英伟达 GTC 2026 大会的现场报道。黄仁勋宣告 SaaS 已死,揭幕 Agent 时代,指出 AI 重心正从训练转向推理,还推出 Vera Rubin、LPX 等新品,强调能效即钱,企业软件将向 Agent-as-a-Service 转变。
The Batch: 899 | 更划算的推理
研究人员提出 Delethink 强化学习方法,训练大模型定期截断推理 token 至固定最大数量,以限制处理长思维链成本。经测试该模型在多方面超基线,且缓解计算成本限制,为长上下文推理提供路径。
Transformers v5 中的分词系统:更简洁、更清晰、更模块化
文章聚焦 Transformers v5 分词系统,介绍分词概念、流程、主流算法,对比 transformers 和 tokenizers 库。着重讲 v5 改进,如架构与词表分离,解决 v4 黑盒问题,还能从零训练专属分词器。
一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”
NVIDIA 推出多模态大模型 OmniVinci,结合架构创新与合成数据流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发“假开源”争议。
4倍速吊打Cursor新模型!英伟达数千GB200堆出的SWE-1.5,圆了Devin的梦!实测被曝性能“滑铁卢”?
Cognition推出全新AI编码模型SWE-1.5,专为软件工程任务设计,运行速度快,在基准测试中成绩良好。它基于GB200芯片训练,有定制编码环境,开发有新战略,还与Cursor新模型Composer对比引发关注。