算法论文8
清华RAM框架让大模型学会“精读略读”
量子位
AI 摘要
清华等团队:提出RAM框架,借鉴人类“精读略读”策略,用于大模型长上下文压缩,突破效率瓶颈,在多任务中性能优越,实现12倍加速,拉近AI与人类认知距离。
阅读原文 · 量子位
清华新框架让大模型学会「精读略读」!实现12倍端到端加速,基准评分翻倍
清华等团队提出全新框架RAM,受人类阅读认知启发,将“精读+略读”混合策略引入上下文压缩,突破现有方法效率瓶颈,在多任务上表现出色,实现12倍端到端加速,为长上下文LLM部署提供新范式。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章7
API Hub低价卖Token的生意经
文章探讨大模型API Hub低价卖Token现象,指出低价出售的常是闲置算力等。分析厂商不官网降价原因,介绍第三方低价来源及Hub盈利途径,给出判断低价Hub能否用的检查清单。
AI Reading Hub
新闻资讯7
孙鹏加盟星尘智能,强化机器人后训练
9月2日消息,前字节跳动Seed团队强化学习专家孙鹏博士加入星尘智能,负责机器人强化学习方向。星尘智能有技术、资本和商业优势,孙鹏经验丰富,此次加入将助力其强化学习后训练发展。
AI前线
产品应用7
Anthropic发布Claude 5.1,最强能力限少数机构用
9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,二者用相同底层模型,区别在安全限制和开放范围。Fable面向订阅用户和企业,Mythos仅向少数审核机构开放,此次还尝试新的开放方式。
AIGC开放社区
产品应用8
阿里Qwen3.8-Flash发布,性价比惊人!
8月大模型厂商多上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四大技术创新,提升了模型效率。
机器之心