「推理模型瓶颈」共找到 8503 篇相关文章
一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”
NVIDIA 推出多模态大语言模型 OmniVinci,结合架构创新与数据合成流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发争议。
一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”
NVIDIA 推出多模态大模型 OmniVinci,结合架构创新与合成数据流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发“假开源”争议。
综述238篇遥感微调!清华院士团队指出9大方向 | CVMJ
在大数据和大模型推动下,遥感微调技术从全参数微调发展到混合微调。清华等团队在CVMJ期刊梳理技术脉络,涵盖适配器、提示等微调方法,还指出9个潜在研究方向,助力遥感技术应用。
奥特曼:OpenAI上市,势在必得
OpenAI完成架构重组,为IPO铺平道路。奥特曼公开AGI路线图,预计十年内迈入AGI时代。重组解除盈利上限,可自由增发股票和上市。微软支持转型,双方续约合作。OpenAI在技术、商业等多方面有新进展与规划。
只要强化学习1/10成本!翁荔的Thinking Machines盯上了Qwen的黑科技
新智元报道,翁荔的Thinking Machines研究同策略蒸馏策略,能以1/10强化学习成本,结合同策略训练优势与密集奖励信号。该策略受DAGGER启发,扩展Qwen3团队工作,可在Tinker复现,还能用于个性化和持续学习。
Google Research 开源新架构,AI 不再依赖云端,直接跑在手表和耳机上
Google Research 开源 Coral NPU 平台,是面向硬件工程师与 AI 开发者的全栈开源方案,可克服 AI 在可穿戴和边缘设备落地的瓶颈,实现能耗与算力平衡,还能解决算力、生态、隐私等问题。
清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源
清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。
NeurIPS 2025 Spotlight | GeoSVR:稀疏体素的新潜力——超越3DGS系列的高精度三维表面重建
计算机视觉中表面重建难题待解,现有方法有瓶颈。北航等团队提出 GeoSVR 框架,围绕几何约束与表面正则化设计,在多数据集超现有方法,兼顾精度、完整性与效率,为多领域提供支持。
斯坦福新论文:微调已死,自主上下文当立
斯坦福大学等机构研究人员新论文指出,依靠上下文工程,无需调整权重,模型也能变聪明。他们提出智能体上下文工程ACE,不依赖模型重训,让上下文自主进化,在多场景测试中表现优于多种方法。
OpenAI奥特曼认错:我天生不适合管理公司
OpenAI CEO奥特曼在a16z采访中回应热点问题,阐述三大核心战略,谈及Sora 2等热点话题,还称自己不适合管理公司。他提到目标、对垂直整合看法、Sora与AGI关系等内容。