「推理模型瓶颈」共找到 8503 篇相关文章

算法论文8

NeurIPS 2025 Spotlight | 条件表征学习:一步对齐表征与准则

文章指出传统表征学习处理图片和商品信息时存在局限,针对性有监督训练成本高,多模态大模型使用成本也需考虑。为此提出即插即用的条件表征学习方法 CRL,实验显示其在下游任务表现优异。

机器之心
推荐文章7

高性能全闪并行文件系统的设计和实践

焱融科技 CTO 张文涛在 QCon 大会分享‘高性能全闪并行文件系统的设计和实践’,介绍了焱融全闪文件存储架构和 YRCloudFile 技术细节,分享其解决 AI 训练存储难题的方案。

InfoQ
算法论文8

告别海量标注!浙大团队提出GUI-RCPO,让GUI定位在无标签数据上自我进化

浙大等机构研究人员提出GUI - RCPO,这是自我监督强化学习方法,能让模型在无标注数据上提升GUI grounding能力。其通过迁移思想,利用区域一致性自我提升,实验表明该方法有效且有泛化能力。

量子位
新闻资讯8

梅花创投吴世春:AI不再卖工具,而是卖收益|甲子引力X

在「渡口——甲子引力X2025科技产业投资大会」上,梅花创投吴世春剖析AI创业投资逻辑。他认为大模型格局已定,资本兴奋点转向应用,AI价值锚点从技术转向商业结果,AI将成基础设施。

甲子光年
新闻资讯8

DeepSeek V4 借实习生获奖论文“起飞”?梁文峰剑指上下文:处理速度提 10 倍、要“完美”准确率

ACL公布2025年获奖论文,中国作者比例超51%。DeepSeek梁文锋通讯、实习生袁境阳一作的论文获Best Paper奖。其提出NSA机制,实验显示性能优、准确率高、速度提升显著,成果或用于DeepSeek V4。

InfoQ
新闻资讯7

小扎AI复仇进行时!OpenAI苏黎世办公室被端,650亿储备金狂烧不止

在AI模型发布趋缓时,科技巨头掀起人才争夺战。Meta从OpenAI苏黎世分部挖走三位顶尖研究员,扎克伯格亲自出马抢人,AI巨头间人才竞争白热化,Meta今年还计划投入650亿美元推进AI野心。

新智元
产品应用8

以加代乘?华为数学家出手,昇腾算子的高能设计与优化,性能提升30%!

大模型落地面临推理难题,华为团队基于昇腾算力发布三项硬件亲和算子技术研究,包括以加代乘的AMLA算子、融合算子技术、SMTurbo加速技术,实现能效、协同和速度突破,未来将拓展应用场景。

机器之心
新闻资讯7

林俊旸Agent创业首次亮相,腾讯已投

前Qwen一号位林俊旸官宣创业公司Pragmatik Labs,方向为做横跨数字与物理世界的下一代Agent。公司获高榕、红杉、腾讯等投资,投后估值达20亿美元。虽无产品模型,但凭借林俊旸过往成绩受关注。

量子位
开源动态8

Codex给V4-Flash装上眼睛,DeepSeek也会文档OCR

GitHub上的项目codex-vision-proxy让接进Codex的DeepSeek能看图,不用换模型或等官方,装本地代理即可。它还附带视觉工具包,在智能文档解析和OCR上潜力大,证明多模态能力可长在管道上。

CourseAI
新闻资讯8

ChatGPT语音杀入桌面!你负责动嘴,一群AI负责干活

近日OpenAI将ChatGPT语音功能正式引入桌面版,其底层是新一代语音模型GPT - Live。大佬们看好语音输入,因其能高带宽传递上下文。该功能不仅能闲聊,还可调度智能体,OpenAI想让ChatGPT成AI工作操作系统。

新智元