算法论文7
1万tokens后18款大模型集体“失智”
量子位
AI 摘要
Chroma团队研究18款主流大模型发现,上下文到1万tokens,模型准确率剩50%。四项对照实验证明,模型性能随输入增长显著且非均匀下降,受语义、结构等因素影响。
阅读原文 · 量子位
1万tokens是检验长文本的新基准,超过后18款大模型集体失智
Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
奥特曼炮轰A社,谈AI发展多方面见解
奥特曼在采访中批评AI安全派观点“反人类”,还围绕AI发展相关问题给出见解。如他认为AI会成伟大技术,但社会和经济适应慢;应让人类掌控未来,用AI赋能人类;谈了算力、产品等多方面事宜。
量子位
新闻资讯8
2026科学探索奖:清华北大等学者入选
2026年「科学探索奖」获奖名单揭晓,50位青年科学家入选,覆盖10个领域。其中信息电子领域5人,包括清华黄高、北大刘譞哲等,他们研究方向多元,成果显著,对AI发展意义重大。
机器之心
推荐文章8
吴恩达详解构建和部署AI应用技能
吴恩达在信中详细展开AI工程技能图谱中构建和部署AI应用这一项,介绍需了解的技能,如LLM基础、用数据为模型提供依据等,并阐述各技能要点,还提及构建AI系统与传统软件的区别。
DeeplearningAI
新闻资讯7
王田苗三问具身大牛,探寻产业破局点
在2026世界机器人大会的圆桌论坛上,王田苗向具身智能头部企业CXO抛出尖锐问题。嘉宾围绕量产卡点、大模型应对物理世界不确定性及产业终局生态展开讨论,并就商业化落地节奏达成共识。
AI科技评论