「超长上下文处理」共找到 1561 篇相关文章
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。
波士顿动力机器人终于有脑子了!人类故意使绊子也不怕
波士顿动力与丰田研究院联手基于大型行为模型,推出Atlas全新版本Atlas MTS。它能听懂自然语言指令、自主规划动作、处理意外。此次升级采用特定模型及策略,还结合VR界面。此外,波士顿动力转向电驱,电驱机器人时代将来临。
马斯克:AI 时代,别这样开会了
马斯克建议取消无价值的大型会议,而当下很多团队开会方式还停留在上个世纪。作者用超级麦吉处理马斯克3小时音频,它表现出色,还具备多种实用功能,与飞书妙记有本质区别,AI或让会议不必要。
苹果M5「夜袭」高通英特尔!AI算力狂飙400%,Pro三剑客火速上新
苹果悄无声息更新官网,三款核心产品14寸MacBook Pro、iPad Pro以及Vision Pro换上全新M5芯片。M5芯片性能提升显著,AI能力连翻数倍,加量不加价,在AI、图形处理等多方面有重大升级。
Granola 为什么能赢:会议笔记,把产品做简单很重要
Granola是新推出一年多的AI笔记产品,迅速成硅谷创业者、投资人常用工具。其创始人认为,“AI笔记”头号竞争对手是苹果备忘录。产品好用关键在于极简“蜥蜴脑设计”与利用用户“上下文”,文中还分享设计思考与实用经验。
大模型再爆弱点!旧记忆忘不掉,新记忆分不出,准确率暴降 | ICML'25
弗吉尼亚大学和纽约大学研究人员用「前摄干扰」概念设计测验PI - LLM,测试大语言模型(LLM)上下文检索能力。结果显示,随干扰增加,模型准确率对数下降至零,提示工程效果有限,需调整模型架构或训练范式。
The Batch:841 | 大语言模型正在纠正历史遗留的不公
美国北加州旧不动产契约含种族歧视条款,虽已非法但人工筛查耗时久。斯坦福和普林斯顿研究团队微调大语言模型识别圣克拉拉县契约中的歧视条款,模型可理解上下文,结果经律师确认,研究成果已开源。
智能体工程的隐形技术债:10分钟造出一个 Agent,公司却要为它养一个平台团队
如今构建智能体容易,但投入生产后会面临诸多问题。文章围绕智能体绘制出集成、上下文湖等七个基础设施模块,分析各模块隐性技术债务,并指出不同阶段债务表现,还提及应对措施及相关会议推荐。
安谋科技Arm China“玲珑”VPU IP来了!瞄准这些应用场景
安谋科技Arm China推出面向AI应用的新一代VPU IP——“玲珑”V560/V760。该产品性能硬核,是“六边形战士”,集高性能、高鲁棒性等六大特性于一身,已完成首批客户授权,助力AI时代视频处理。
高效大规模创新3D重建模型iLRM
多数基于Transformer架构的模型处理多视图输入有可扩展性问题,成均馆大学、延世大学研究人员提出创新3D重建模型iLRM。它通过迭代细化机制生成3D高斯表示,有独特架构设计和高效注意力机制。