新闻资讯9
字节实习生曝DeepSeek-V4缺陷
AI前线
AI 摘要
字节Seed团队联合多校研究发现,DeepSeek-V4分块KV压缩机制存在长文本检索周期性盲区,不同位置检索准确率差最高达40.23个百分点,传统评测平均分掩盖了该缺陷,DeepSeek V4.1仅缓解未根除。
阅读原文 · AI前线
字节Seed实习生曝DeepSeek-V4技术缺陷:长文本检索陷入“周期性盲区”
字节Seed团队联合多校研究,发现DeepSeek-V4的分块KV缓存压缩架构存在长文本检索周期性盲区,不同Token位置检索准确率落差最高超40个百分点,揭露了传统长文本评测的盲区,DeepSeek已在V4.1改善但未完全消除缺陷。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章9
记忆是Agent走向RSI的核心关键
本文结合OpenAI、Anthropic的最新AI研发动向,指出RSI是Agent自进化的核心方向,记忆是RSI的关键基础,介绍了MemoraX的记忆驱动RSI体系与多场景实践成果。
机器之心
新闻资讯9
24天Jev逆袭估值达75亿美元
本文报道,前OpenAI核心成员创办的TypeSafe AI推出砍掉生成功能、只做决策的AI模型Jev,上线仅24天估值从2亿美元暴涨至75亿美元,引爆AI决策新赛道,科技巨头纷纷跟进布局。
量子位
算法论文8
最强AI Agent团队仅完成半数协作任务
单个AI Agent能力不断提升,但多智能体协作能力缺乏系统评测。本文介绍新推出的AgentWorld评测基准,结合长时程任务、角色不对称与黑盒交互,评测多智能体协作能力,给出主流大模型的协作表现数据。
InfoQ
新闻资讯9
OpenAI发722篇数学成果搅乱学界
OpenAI公开722篇由内部未发布前沿模型生成的数学成果,覆盖多数学方向,部分附带形式化证明,发布后引发数学界巨大冲击,消化验证需数年,不少青年学者研究项目遭毁灭性打击,本文梳理各方反应与争议。
机器之心