降本方案」共找到 1379 篇相关文章

开源动态7

强迫模型自我争论,递归思考版CoT热度飙升!网友:这不就是大多数推理模型的套路吗?

近日,概念CoRT火了,它在CoT基础上加了“递归思考”,能让AI递归思考响应、生成替代方案并选最优,结合“结构化自我批判”提升推理力。不过网友质疑它是“新瓶装旧酒”。

机器之心
6

增长密码:大型网站百万流量运营之道

书深入探讨了大型网站SEO的底层逻辑,分享了作者在SEO行业12年的成功经验,从底层逻辑到顶层思维,通过实际案例让读者掌握大型网站流量运营的精髓。

胡勇
产品应用8

刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路

Claude Fable 5.1虽可兼容旧版提示词,但行为习惯有变化。官方整理提示词与工程落地指南,涵盖思考程度、工具调用进度汇报、独立工具批量调用等多方面使用技巧和避坑细节。

AI寒武纪
算法论文8

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高低93.2%

随着模型规模增长、新应用兴起,大模型基础设施面临管理「张量状态」挑战。北大、阶跃星辰与北邮联合提出 TensorCast,解耦张量状态,复用管理能力,在多场景测试中表现出色,为大模型基建提供新范式。

机器之心
开源动态7

Claude水印已被破解,斩获11k Star!但会被拒绝安装

Anthropic为Claude生成文添加隐藏水印,引发争议。很快有开源项目可去除Claude、Gemini、OpenAI水印,获11k Star,但Claude拒绝安装。反对与支持水印者观点不一,双方展开猫鼠游戏。

机器之心
算法论文7

拟合接近满分,外推却会跑偏:Meta 给缩放律加了一个指数

大模型训练前,团队常用 Chinchilla 缩放律估算模型规模和数据量,但它在模型和数据极不平衡的边界预测易跑偏。Meta FAIR 提出的 Skaling 只增加一个耦合指数,低外推误差,还采用 L 形采样低试算成

深度学习自然语言处理
产品应用7

训练世界模型,开始从人类的肌肉和脑子里偷师了

具身智能数据竞争进入新阶段,第一视角视频虽缓解数据量问题,但未记录人行动的原因及大脑身体实时修正。FaceMind提出Ego - NeuroLoop数据范式,配套NeuroMatrix和NeuroBooster,将训练数据从“行为库”推向“闭环库”。

量子位
开源动态8

阶跃开源JetSpec,大模型推测解码提速近10倍

随着Agent应用爆发,大模型推理效率成AI行业焦点。阶跃星辰联合多校团队开源JetSpec,该框架面向推测解码,在H100上把MATH - 500解码速度提升到9.64倍,突破了推测解码的扩展天花板。

AIGC开放社区
开源动态7

33.5k星星爆火!这个开源插件让AI不再写屎山,token自然就省下来了

Ponytail是开源插件,将资深工程师工程直觉整理成skill规则,供Claude Code等AI coding agent加载。它让AI开发更克制,减少代码量、成,提升速度,核心是强制AI做复杂度判断。

开源AI项目落地
产品应用7

京东广告大模型实战:GRAM 架构如何在 50ms 内完成生成式推荐?

流量红利见顶,广告营销转型遇挑战。京东张泽华在大会公开应对方案,介绍 GRAM 架构,实现意图与商品语义对齐,控制推理时延,解决冷启动等问题,还分享算法与知识工程实践。

InfoQ