「token使用」共找到 1878 篇相关文章
破天荒!DeepSeek V4正式版居然要涨价,而且翻着倍地涨
DeepSeek官方邮件称7月上线V4正式版,高峰时段API各类token价格翻倍,但其他时段仍维持低价。此前它一直以低价著称,此次涨价或与算力紧张、自建数据中心有关,且更新将带来功能优化和性能提升。
1.4K Star!不要问答,要完成任务,一个合格的金融Agent应该是什么样?
过去一年AI Agent火热,但金融场景投研是长链路任务,有诸多硬约束。LangAlpha是Ginlix AI推出的开源金融Agent项目,能解决实际金融研究任务,有核心架构和关键能力,还给出使用方式、典型Demo及横向评测。
英伟达MIT出手!华人团队重磅开源,大模型推理内存暴降10倍
英伟达、MIT、浙大华人研究者联合推出TriAttention,核心是在pre - RoPE空间用Q/K三角集中度估计KV token重要性,保留关键部分。它使内存消耗降10倍,吞吐量提2.5倍,还提供vLLM集成和MLX实验性支持。
亚马逊云科技 AI 助手终于来了,一出手就对标 Cowork
亚马逊云科技推出 AI 助手 Amazon Quick,对标 Claude Cowork。它是 AI 驱动的桌面办公助手,可通过自然语言完成多项办公任务,还能连接多种办公工具,在国内使用体验好,体现了 AI 办公从‘工具增强’走向‘流程重构’。
Hermes推出Curator功能:自动清理Skill 仓库
Hermes推出Curator功能解决技能仓库膨胀问题。它每7天(可配置)自动运行,检查技能使用频率等数据,将30天未用技能标记为‘stale’,90天未用的移至归档目录,还能建议技能合并方案。
跑分第一,推理暴跌!Claude Opus 4.7上线48小时口碑崩了
Claude Opus 4.7发布48小时口碑两极撕裂。官方榜单并列全球第一,但逻辑推理公开测试成绩暴跌,token消耗涨35%,旧接口报错,用户吐槽「更贵、更蠢、更爱顶嘴」,Anthropic虽解释却难平用户怒火。
老黄入局吃龙虾!英伟达发布最强开源Agent推理模型
英伟达发布并开源120B参数的MoE模型Nemotron 3 Super,在多项测试中表现出色。它原生支持100万token上下文,吞吐量大幅提升。英伟达还计划五年投260亿美元构建开源AI模型,开放全参数权重等。
Claude 开始收“代码审核税”:一条 PR 25 美元,大厂一年或花百万,还得上交整个代码库
3月9日,Anthropic推出代码审查产品Code Review,运行在GitHub和CI流程,按token计费,每次15 - 25美元,速度约20分钟/次,用整个代码库分析。虽能发现问题,但价格贵、速度慢,还遭“既当运动员又当裁判”质疑。
互联网已死,Agent 永生
文章指出互联网时代诸多概念如DAU、SaaS等已过时,因旧前提‘人是软件用户’改变,新前提是‘Agent是软件新主人’。还阐述Agent时代四块基石,如Token是特权、Agent是人口红利等,强调新旧世界差异大。
前端同事看走眼了,这个“游戏网页”其实全是AI写的!
Kimi K2.5上新,集视觉理解、代码生成等能力于一体,提供四种使用模式,其中Agent集群模式提效显著。实测显示其网页生成、动效理解能力出色,下一代K3模型或用新架构KDA降低计算成本。