「每Token成本」共找到 2051 篇相关文章
AgentFly:重塑Agent,无需微调LLM,如我们一样的记忆和经验持续学习
现有LLM智能体依赖静态流程或微调参数,缺乏灵活性且成本高。论文提出基于记忆的在线强化学习框架AgentFly,不更新LLM权重,在多基准测试表现出色,为构建通用智能体提供新范式。
CJA | 北航罗明强教授团队:一种基于生成式人工智能的快速结构化飞行器概念设计方法
目前人工智能为飞机概念设计提供方案,但存在数据需求大等问题。北航罗明强教授团队提出基于LLMs的设计方案生成方法,开发原型系统,实验表明LLMS有相当设计能力,该方法可降成本、提效率。
突发!字节开源 36B 模型Seed-OSS
字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座版本,Instruct版在多方面表现强劲,性能碾压OpenAI开源模型。
训练提速5倍,响应缩短50%:动态自感知能力,重塑高效LLM Reasoning范式
大型语言模型“思维链”技术有冗余,传统优化方案存在静态先验与动态能力错配问题。论文提出的DR.SAF框架赋予模型动态自感知能力,通过三模块协作,实现推理“精准瘦身”,解决根本冲突。
2025全球大模型应用报告:红海混战「忠诚度」瓦解,用户脚踏4.7条船!
2025年上半年大模型从技术走向生产,45%企业将其用于生产环境。用户付费方式多样,使用面临知识不足、成本高的挑战。市场红海竞争,用户平均用4.7家大模型,国产模型出海需借第三国。
双“雷”暴击!Trae 被曝资源黑洞、Claude背刺超级付费党,开发者们被“刀”惨了
AI编程应用大热,但运行卡顿、资源消耗惊人等问题随之而来。Trae被曝过度消耗资源,Anthropic宣布Claude Code对付费用户增加调用限制,反映出AI产品资源问题影响厂商和用户。
实测爆火的阶跃星辰Step 3,性能SOTA,开源多模态推理之王
在 WAIC 2025 前一天,阶跃星辰推出新一代基座模型 Step 3,它是开源 VLM 新晋之王,性能超同类别开源模型,与顶尖闭源 VLM 也有一战之力。该模型具备多开好省特点,还展示了宏大技术生态与商业化布局。
全网爆火的Kimi-k2驱动Claude Code亲测可食用版本来了「附详细配置」
Claude Code好用但贵,Kimi-k2表现不错且API价格便宜。月之暗面团队为Kimi K2提供与Anthropic兼容的API端点,文章给出在Claude Code使用Kimi K2的亲测配置方法。
比女皇报告还炸裂!67页AI深度调研刷屏,全球LLM大决战真正开始
硅谷财富管理巨头Iconiq Capital发布《2025年AI现状报告》,实测300家AI公司落地路径,揭示AI从概念走向实战的七大真问题,解析从构思到部署AI产品路径,核心关注高效构建、规模化落地等。
我用扣子空间制作了档小宇宙播客《语出惊人》,借AI之口犀利对谈人生困境,效果惊艳
作者在All in AI后运营AI Reading Hub公众号,有每日文章和语出惊人两个板块。体验notebooklm后,用扣子空间制作小宇宙播客《语出惊人》,借AI探讨年轻人关注问题,后续会持续更新。