「Token价格」共找到 907 篇相关文章
上交大和辉羲把LLM刻进ROM!推理性能冲2万token/s,GPU时代终结?
硅谷Taalas将大模型‘物理焊死’进芯片引关注,而上海交大、辉羲智能与微软亚洲研究院团队用ROM+SRAM异构架构,将端侧LLM推理速度推至20,000 tokens/s。介绍了ROMA和TOM架构优势及应用场景。
2.9K Star!这个工具让 Agent 查代码快了 200 倍!节省 98% Token 消耗!
当下,Agent 在代码工作流应用广泛,但在大型代码库搜索时存在精准性、Token 效率和速度问题。Semble 是 MinishLab 团队开发的面向 Agent 的代码搜索工具,能解决上述问题,还具备多方面亮点,安装和使用也简单。
价格狂飙6倍!Claude凌晨上线极速模式,网友集体破防:比OpenAI还黑
Anthropic深夜上线Claude Opus 4.6极速模式,速度提升2.5倍但价格飙6倍,引发开发者不满。不过Opus 4.6实力强劲,多项评估领先。Fast Mode是市场试探,反映AI行业关注从‘能做什么’到‘多快做到’转变。
马斯克放出编程界价格屠夫!Grok Code Fast 1:更快,更省,还免费
近日,马斯克旗下xAI发布全新编程模型Grok Code Fast 1,它为“代理式编程”而生,靠全新架构实现高速代码生成。在技术出色的同时,价格低廉还限时免费,虽在部分场景有不足,但仍是开发者实用工具。
华为云再掀算力风暴:CloudMatrix384超节点将升级,Tokens服务性能最大可超H20四倍
华为云在全联接大会2025发布新进展,如CloudMatrix超节点升级、首创EMS服务等。其以“算力黑土地”理念,用智算+通算策略满足产业需求,Tokens服务优势显著,还支撑多领域应用。
传Claude sonnet 5即将发布:能自动组建开发团队,一人即一公司,价格爆降50%
小道消息称Anthropic下一代AI模型Claude Sonnet 5或于北美时间2月3号发布,代号“耳廓狐”。它有全新功能,能化身虚拟开发团队,编程能力强,价格将降50%,还与谷歌深度合作。
AI Infra进入自进化时代!清华团队用「AI优化AI」造就国产万亿Token工厂
AI自主优化RSI成新焦点,被视为通往AGI的关键路径。硅谷为此沸腾,中国也不落后。清昴智能由清华团队创立,率先打造自进化算力底座,还基于国产算力打造万亿Token工厂,目标是让优化成为持续运行的基础能力。
「上下文学习」之后,腾讯混元第二篇公开研究:精准定位RLVR训练崩溃的“罪魁祸首”Token
腾讯混元团队新研究提出异常梯度定位器 GradLoc,可将全局梯度突刺定位到具体异常 token,降低 RLVR 训练观测与分析门槛,助力解决训练不稳定问题,让模型调优更科学。
跳出英伟达生态:OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,速度达 1000 token每秒
OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,跑在 Cerebras 晶圆级芯片上,速度达每秒超 1000 个 token,比传统 GPU 推理快约 15 倍,这是其跳出英伟达生态的里程碑。
AI编程节省95% token,工具调用上限狂飙20倍,开源记忆系统登顶GitHub热榜
Claude - Mem是一款登顶GitHub热榜的持久化记忆系统,直击AI编程助手跨会话失忆痛点。它免费且省token,通过‘三层渐进式披露’架构,常规省90%,测试阶段省95%,工具调用上限提20倍。