「可重构计算」共找到 5274 篇相关文章
安谋科技Arm China闪耀2025全球计算大会|赋能绿色算力,加速AI普惠
安谋科技Arm China受邀出席2025全球计算大会,参与多项活动。深度参与撰写《算力经济绿色研究发展报告》,推进本地化标准建设,还在具身智能领域发力,其“周易”NPU IP将助力具身智能落地。
ACL 2026 综述:从事后解释到内生解释,大模型内生可解释性的前沿进展
大语言模型强大但解释性成问题,过去多事后解释,现更多研究者转向内生可解释性。ACL 2026 接收的综述论文梳理相关代表方法,总结为五类核心设计范式,指出该方向面临挑战但趋势清晰。
重磅!中国团队发布SRDA新计算架构,从根源解决AI算力成本问题,DeepSeek“神预言”成真?
国内玉盘AI团队发布《SRDA AI大模型专用计算架构》白皮书,提出全新SRDA计算架构,从硬件源头解决AI算力成本瓶颈。它以数据流为核心,在内存、网络等方面创新,为开发者带来高效、低成本等价值。
生成式推荐补上关键一环!语义ID首次实现可微分联合优化 | SIGIR'26
生成式推荐依赖语义ID,可现有语义ID常先学好再冻结,与推荐目标不一致。论文DIGER首次将可微分语义索引机制引入生成式推荐框架,让推荐损失参与语义ID学习,还设计策略解决训练问题,实验表现佳。
谷歌诺奖大神哈萨比斯:五年内一半几率实现AGI,游戏、物理和生命的本质都是计算
谷歌DeepMind掌门人Demis Hassabis与Lex Fridman深度对话,预测未来五年有50%几率实现AGI,还从新颖角度阐述自然界模式可被建模,畅谈AI对游戏、科学研究等多领域的影响及应用。
大模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率
Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,小模型成本”。
超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破
文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。
英伟达推出下一代计算平台Rubin:可用45°C的热水进行冷却,训练速度提高3.5倍
英伟达黄仁勋在CES演讲,宣布进入自动驾驶领域、推出Alpamo模型与下一代计算平台Rubin。他指出计算行业正经历平台性转变,还介绍AI进展、应用架构,Rubin平台性能强且能效高。
攻克AI过度思考难题!美团新研究让通过“可验证”过程奖励激活LRM的高效推理
美团等机构研究团队针对LRM“过度思考”问题,提出可验证的过程奖励机制(VSRM)。它结合可验证奖励与步骤级奖励,为推理步骤分配奖励信号。实验显示其能降低输出长度并保持性能。
12月首炸!可灵 O1 正式发布,全球首个统一多模态视频大模型,强得可怕!
12月快手旗下可灵发布全球首个统一多模态视频大模型Kling O1,标志AI视频进入“全流程语义控制时代”。它将多种视频创作能力统一,有全能引擎等五大亮点,性能对比优势明显,让AI视频生成更可控。