「语言中心推理」共找到 3069 篇相关文章
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。
最强多模态模型也拿不到30分?DeepImageSearch定义相册搜索新范式,开启个人视觉记忆的深度搜索时代
人大窦志成教授团队联合OPPO研究院提出DeepImageSearch图像检索新范式,将其从“逐张语义匹配”推向“语料库级上下文推理”。团队构建评测基准DISBench,用ImageSeeker框架评测主流模型,结果显示最强模型单次完美解决查询比例不超三成。
强化学习之父Richard Sutton:人类数据耗尽,AI正在进入“经验时代”!
强化学习之父Richard Sutton在演讲中指出,人类数据耗尽,AI正进入“经验时代”,真正的AI要从与世界互动的“经验”中获取数据。他还认为创造超级智能体是好事,人类和AI繁荣应基于“去中心化合作”。
Ilya的首个模型来了!
掌握内幕的草莓哥爆料,Ilya正构建以TTT为核心的小型推理引擎。他预见传统大模型的死穴,SSI将TTT概念落地,其引擎在数据效率等方面优势明显。SSI获投资,本月或发新模型。
50FPS、成本打掉70%,魔芯MoWorld把世界模型带进产业时代
近期,魔芯科技联合浙江大学潘云鹤院士、华为等发布实时交互世界模型MoWorld,推理速度超50FPS,部署成本仅为同规模GPU方案的30%。它全链路优化,将用于多行业,魔芯也完成亿元美金融资。
Qwen拿半成品刷下AIME'25满分,给别人留点面子吧……
开源之王Qwen的Qwen3“超大杯”推理版虽为早期预览版,仍在训练中,但已在AIME 25和HMMT25达100%准确率,超GPT - 5系列。该预览版可在Qwen Chat免费试用,API已上线阿里云。
斯坦福、英伟达和伯克利提出具身Test-Time Scaling Law
斯坦福、英伟达和伯克利团队提出具身Test - Time Scaling Law。研究发现推理时增加计算量可提升VLA模型性能,揭示动作误差与采样数量幂律关系,还探讨关键问题,给出方法,实验证明结合RoboMonkey能显著提升性能。
ImageNet作者苏昊被曝任教复旦
ImageNet作者之一苏昊被曝要去复旦任教。他是具身智能领域论文被引次数最高的华人学者,主导多个奠基级项目。他研究从语言到2D、3D视觉,再到机器人,还创办具身智能公司Hillbot。
这次,LLM黑盒被LLM打开了~
随着大语言模型(LLM)能力提升,其内部机制更不透明。概念描述新范式用另一个 LLM 自动生成自然语言解释。介绍了描述对象、生成方法、评估指标,还提及社区关注方向,指出结合多种手段才能把解释变知识。
光刻机巨头变身AI金主,Mistral AI成欧洲估值最高初创企业
法国初创公司Mistral AI在2025年9月完成20亿欧元融资,估值达140亿美元,成欧洲估值最高科技初创企业,由阿斯麦牵头投资。该公司技术实力强,模型参数效率高、架构创新,还注重开源和多语言支持。