「上下文成本」共找到 2084 篇相关文章
国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5
蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例低降低运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。
前 Codex 大神倒戈实锤!吹爆 Claude Code:编程提速 5 倍,点破 OpenAl 死穴在上下文
OpenAI Codex 早期研发者 Calvin French - Owen 在播客中锐评代码智能体,偏爱 Claude Code,称其搭配 Opus 模型写代码速度提 5 倍。他强调上下文管理重要性,还对比了 Claude Code 与 Codex 产品理念差异。
最强编码模型 Fable 5.1 发布:性能翻倍、Agent 成本降 45%,Anthropic 把顶级模型送进真实世界
当地时间9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,新模型在多方面能力提升,Agent工作负载成本最高降45%,此次发布还涉及价格、数据留存等多方面内容,争夺高价值任务市场。
港科广×腾讯联手打造《我的世界》神操作,400张截图就能让AI挖矿通关,成本降至5%|EMNLP 2025
港科广与腾讯联合团队提出VistaWise框架,将“跨模态知识图谱+轻量化视觉微调”引入开放世界智能体。实验显示其在“获取钻石”任务表现出色,成果被EMNLP 2025主会录用。该框架以低成本、跨模态为突破口。
Karpathy最新手搓!复现GPT-2成本狂降600倍:仅需507元3小时训练「最好的AI学习项目」
Andrej Karpathy的个人项目nanochat更新,现训练GPT - 2级别的LLM成本低于100美元,在单个8XH100节点上仅3小时花约73美元,较7年前成本降600倍,还列出关键优化技术,设排行榜。
LLM的“记忆外挂”来了!Supermemory新API:一行代码让LLM记忆“无限+省钱90%”
Supermemory公司发布Infinite Chat API,能让任何LLM有近乎无限上下文长度。用户一行代码就能切换,可扩展上下文、省90%成本、提性能,已上线,有免费试用额度,后续有固定费用和用量计费。
告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代
大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。
Cursor 重新定义 Agent:脑子再大,不如会翻书。
Cursor 分享博客指出,Dynamic Context Discovery 效果远好于 long context 方式,开启动态上下文可使总 Token 消耗降 46.9%,还能减成本、降延迟、提准确率,但也存在成本转嫁、工程复杂度高和安全风险等问题。
LLM近期重大架构进化一览:从Gemma 4到DeepSeek V4
近期大模型长上下文需求增长,成本问题凸显。Google Gemma 4、Poolside Laguna XS.2、Zyphra ZAYA1 - 8B、DeepSeek V4 等模型各有架构优化,如 Gemma 4 跨层 KV 共享和 PLE,以降低长上下文推理成本。
豆包 Seed 2.0 Lite升级:给 Agent 装上眼睛和耳朵
近期模型发布竞争激烈,作者做视频字幕常遇识别错误,因语音识别工具缺上下文。字节方舟的豆包 Seed 2.0 Lite 升级后能听,还可结合上下文准确输出字幕,成本降 20%,也能理解视频,为工作流补全感知。