大推理模型」共找到 9522 篇相关文章

算法论文7

Energy | 西工史子颉、高传强等:三维风力机叶片动态失速数据融合建模研究

动态失速威胁风力机叶片安全与发电效率,传统模型有局限。西工团队开发数据融合神经网络与动量叶素理论耦合框架,能高效高精度预示三维叶片动态失速,虽部分工况有偏差,但预测精度显著提升。

力学与人工智能
算法论文8

Gemini准确率从21%飙到97%!谷歌只用了这一招:复制粘贴

Google Research研究发现,将输入问题复制粘贴一遍,能让模型在非推理任务上准确率惊人提升,如Gemini 2.0 Flash - Lite从21.33%升至97.33%,且几乎不影响生成速度,但不适用于推理场景。

新智元
产品应用7

500万次围观,1X把「世界模型」真正用在了机器人NEO身上

1X公司为机器人NEO引入1X World Model,使其学会‘想象’。该模型借助视频预训练,不依赖规模机器人数据和遥操作演示,能泛化到新场景。实验显示其在多任务上表现不错,但精细操作有挑战。

机器之心
新闻资讯8

多模态技术爆发元年,行业应用如何落地?

InfoQ《极客有约》X AICon 直播栏目,邀上海交赵波、快手高欢、腾讯邵帅探讨多模态模型。谈及技术挑战、开源闭源、行业落地等,还分享精彩观点,如先后小蒸馏提效,垂直模型现阶段更优。

AI前线
新闻资讯8

头部互联网企业交锋,AI时代可观测边界出现了吗?

InfoQ《极客有约》X AICon 直播栏目邀阿里云张城等探讨AI时代可观测新边界。嘉宾们认为AI与可观测技术双向赋能,传统算法与模型互补,未来有望实现半自治运维,还分享了数据治理等经验。

InfoQ
算法论文8

ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速

琶洲实验室等团队提出潜在空间压缩注意力(LCA),入选 ACL 2026。LCA 突破传统注意力机制瓶颈,适配不同模型,降低硬件门槛与成本,提升推理效率。论文与代码已开源。

机器之心
开源动态8

LLM开源2.0洗牌:60个出局,39个上桌,AI Coding疯魔,TensorFlow已死

9月13日蚂蚁集团开源团队发布LLM开源2.0全景图,收录114个项目,39个新晋、60个出局。生态洗牌,Agent层活跃,分类架构细化。AI Coding等领域发展显著,TensorFlow不敌PyTorch,还梳理厂商模型发布情况。

机器之心
开源动态8

华为开源7B多模态模型,视觉定位和OCR能力出色,你的昇腾端侧“新甜点”来了

华为推出开源多模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在多核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来新选择,丰富昇腾生态。

量子位
算法论文8

RL 将如何提高具身模型 VLA 泛化性?清华学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异

清华学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。

机器之心
开源动态8

英伟达成开源新王?Nemotron 3全新混合专家架构,推理效率升4倍

北京时间今天凌晨,英伟达发布 Nemotron 3 系列开放模型,含 Nano、Super 和 Ultra 三种规模。Nano 已上线 Hugging Face,采用混合 MoE 架构,推理效率提升显著。该系列还具备多种核心技术和实用能力,相关工具和数据集也已开源。

机器之心