「推理计算」共找到 2581 篇相关文章
LeCun 两连推!LeJEPA 核心作者最新论文,改写 JEPA 表征坍塌困局
社交平台X上,研究工作VISReg获图灵奖得主Yann LeCun两连推。它精准命中JEPA世界模型核心痛点——表征坍塌,不靠“外挂”、仅用1/10数据,就在15个数据集上力压7大主流自监督学习算法。
Mimo Code 爆火:我们挖开源代码,找到小米 AI 的真创新
6月11日小米MiMo团队开源MiMo Code项目,定位终端编程Agent。它基于anomalyco/opencode,虽有创新但引发争议,有人肯定工程设计,也有人质疑fork行为和运营节奏,本文还探讨了Harness方向与开源意义。
让大模型“边看边改”,视觉分割准确率直接上涨9% | ICML 2026
复旦、创智联合推出RSAgent,让多模态大模型通过多轮工具调用生成准确掩码,解决视觉分割难题。该工作入选ICML 2026,实验显示其在多个测试集上表现领先,还展示了从‘看图问答’到‘视觉行动’的路径。
AMD 苏妈对话李开复:AI 转型只能由 CEO 驱动、未来“DRI”(直接负责人)将是企业核心|直击现场
2026 AMD AI 开发者日上海站,AMD 苏姿丰阐述 AI 愿景及中国战略。她与李开复对话,李开复认为 AI 跨越编程临界点,多智能体架构是突破,AI 转型需 CEO 驱动,未来 DRI 将成企业核心。
国产GPU组了个开源局,把SGLang等核心开发者都摇来了!
国产GPU玩家摩尔线程举办SGLang × MUSA Meetup,邀请众多开源圈开发者。活动探讨如何让国产GPU进入大模型推理主流开源工程链路,显示国产GPU竞争迈向生态坐标之争。
图像编辑模型不止生成:BIGAI&上交大提出EAR范式,系统测试其视觉规划能力
上海交通大学联合北京通用人工智能研究院提出EAR范式,构建AMAZE基准,分析图像编辑模型视觉推理能力。研究发现模型零样本表现弱,扩散式模型更适合视觉规划,CoT效果不稳定等。
鹏城实验室 X 中大hcp实验室推出 RADAR : 具身智能评测的新标杆
RADAR是鹏城实验室与中大hcp实验室为具身智能领域设计的评测基准,解决现有评测体系三大缺陷,通过创新设计揭示模型不足,为研究者提供方向,推动具身智能实用化。
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。
GPT-5.4 发布,OpenClaw的能力要被取代?OpenAI 新模型不仅会自己用电脑,编程能力也拉满了
今天 GPT-5.4 发布,整合推理、编程及原生计算机使用能力。其原生电脑操作能力提升,与 OpenClaw 竞争。还带来工具搜索降成本、减少幻觉,编程能力增强但价格也升级。
IC产量增长10.9%、换道超车……今年“两会”的“芯”消息令人振奋
2026年全国“两会”进行中,“政府工作报告”显示2025年科技创新成果丰硕,如集成电路产量增长10.9%。代表委员对半导体等建言聚焦质的飞跃,还给出芯片产业化、算力布局等“解题思路”。