低熵token」共找到 1591 篇相关文章

7

月烧35万元token、逼得Claude官方连夜限速!被全网吐槽的中国“榜一大哥”,已经靠 AI 年入千万了

X 用户“刘小排”认领月耗 5 万美元 Claude Code token。他靠 AI 年入近千万,用 AI 开发产品,还分享找需求、做产品等经验。他认为 AI 是长期机会,能放大个人能力。

InfoQ
开源动态8

延迟的端到端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!

随着语音应用场景普及,语音大模型响应慢成瓶颈。VITA团队开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完全开源,有超延迟等优势。

开源星探
新闻资讯7

月烧35万元token、逼得Claude官方连夜限速!被全网吐槽的中国“榜一大哥”,已经靠 AI 年入千万了

X用户“刘小排”认领30天按200美元计划消耗5万美元Claude Code token一事。他靠AI年入近千万,用Claude Code做产品,回应网友质疑,称在规则内使用,还分享创业经验,认为AI是长期机会。

AI前线
算法论文8

警惕!大模型成本倒挂:你正在为模型的多余「思考」买单

一项来自多所高校和微软研究院的研究揭示AI模型价格倒挂现象,定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
产品应用7

对话 Elys 创始人 Tristan:人的灵魂是所有 context 的总和,我们从未被真正连接过

本文是极客公园创始人张鹏与 Elys 创始人 Tristan 的对话。Tristan 认为产品应围绕 context 构建,Elys 结合记忆、推荐等系统,要打造社交世界,还介绍了产品设计、用户导入等方面内容。

Founder Park
开源动态8

Paddle OCR走到了尽头,Unlimited OCR一次读40 页

百度开源的Unlimited OCR把解码器里全部attention层换成R - SWA,模型只记128个token,能一次性读完40页文档。相比DeepSeek OCR,它在精度、速度上表现更优,训练成本,适用范围广。

CourseAI
算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。

机器之心
推荐文章7

对话 Elys 创始人:他的 10 个产品洞察,和他想创造的下一代社交网络

极客公园与 Elys 创始人 Tristan 深度对话,分享 10 个产品洞察。他认为 context 价值大,做新 AI 产品要找好形态,记忆系统本质是推荐系统,还阐述了对 AI 社交等看法,目标是创造社交网络。

Founder Park
开源动态8

Kimi K2发布两天即“封神”?80%成本优势追平Claude 4、打趴“全球最强AI”,架构与DeepSeek相似!

国内独角兽月之暗面发布并开源 Kimi K2 模型,推出两天就在 OpenRouter 平台 token 使用量超 xAI 的 Grok 4。它成本、性能强,编码能力追平 Claude 4,架构与 DeepSeek 相似,技术研究也多次‘撞车’。

InfoQ
算法论文8

斯坦福英伟达推出测试时强化学习:微调开源模型胜过顶级闭源模型,仅需几百美元

斯坦福、英伟达等提出TTT - Discover方法,基于开源模型gpt - oss - 120b,在测试阶段引入强化学习更新模型权重。它采用目标函数和PUCT启发机制,解决分布外问题,成本且表现优,但目前适用于连续奖励场景。

量子位