新闻资讯7
DeepSeek-V3.2被指存在token消耗bug
量子位
AI 摘要
研究人员:DeepSeek-V3.2存在浪费token问题,GRPO算法有‘长度偏见’和‘难度偏见’,虽修正‘难度偏见’,但‘长度偏见’仍在,官方也承认token效率是挑战。
阅读原文 · 量子位
DeepSeek-V3.2被找出bug了:疯狂消耗token,答案还可能出错,研究人员:GRPO老问题没解决
DeepSeek-V3.2虽强且火爆,但被发现存在bug,即浪费token问题。研究者指出这源于GRPO算法的‘隐藏偏见’,虽修正了‘难度偏见’,但‘长度偏见’仍在,官方也承认token效率是挑战。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用7
Codex开放1M上下文,GPT - 5.6 Sol封印解除
现在3行配置就能让GPT - 5.6 Sol封印解除,在Codex里用上1M上下文。不过有网友警告轻易别用,因超出默认窗口,模型消耗token速度会翻倍,且模型上下文利用能力会下降。此外,Codex确定会上Astra。
量子位
新闻资讯7
Opus 5暂缓发布,实测有优有劣
全网苦等Opus 5,结果其暂缓发布,理由是怕威胁人类对高级AI的控制,遭网友怒批。部分开发者提前实测,它3D细节表现出色,但耗token且看图测试翻车,原定有诸多强大特性。
新智元
推荐文章7
Claude Code:玩转AI智能体循环
Claude Code团队将“循环”定义为AI智能体不断重复执行工作周期,直至满足预设停止条件。文章介绍了回合制、目标导向、基于时间和主动式四种循环类型、适用场景及控制token消耗方法,还给出保证代码质量的原则。
宝玉AI
新闻资讯7
Claude上线新功能就宕机,Anthropic翻车不断
4月6日Claude新功能Ultraplan上线就遭遇大规模宕机,开发者看到满屏‘授权失败’等。此前源码泄露,现又被指修改系统提示词报错、性能下降。虽Ultraplan有效果,但token消耗大,Anthropic太急,产品稳定性堪忧。
新智元