「全模态推理」共找到 3724 篇相关文章
腾讯AI Lab 提出解耦推理新框架,破解IMO 数学难题
腾讯AI Lab梁振文和宋林峰提出“解耦推理与证明”框架,解决当前大语言模型在自动化定理证明领域“思考”与“证明”能力失衡问题,成功解决5道IMO难题并开源成果。
数千大模型全跑「中国芯」!最后一公里已「焊」通
国产芯片运行大模型需额外适配,魔乐社区以开源模型推理适配协作模式破局。它推出‘模型推理适配协作计划’,联合多方力量,打通国产算力与大模型应用‘最后一公里’,还举办赛事激发创新活力。
这个推理模型:HRM ,只用2700万参数,超越了DeepSeek和Claude
Sapient Intelligence研究者受大脑机制启发提出分层推理模型HRM,它是全新循环架构,仅2700万参数、1000个训练样本,就在复杂推理任务上表现卓越,还引入近似梯度等方法,有推动通用计算变革潜力。
单目3DGS迎来突破:影石开源UniSHARP实现全相机适配
影石研究院发布单目新视角合成模型UniSHARP,可通过单次推理秒级获场景高斯点云,支持混合相机训练与免标定推理,适配所有相机。团队还构建数据集、设benchmark,代码等均已开源。
强化学习新发现:无需数学样本,仅游戏训练AI推理大增
莱斯大学、约翰斯・霍普金斯大学和英伟达研究团队有颠覆性发现,让多模态大语言模型玩简单游戏,无需数学样本,就能显著提升其多模态推理能力。提出的ViGaL方法在多个基准测试中表现出色。
微软开源新版Phi-4:推理效率暴涨10倍,笔记本可运行
今天凌晨微软官网开源Phi - 4家族最新版Phi - 4 - mini - flash - reasoning,它参数小性能强,适合边缘设备。采用自研SambaY架构,推理效率涨10倍,延迟降2 - 3倍,多场景测试表现优异。
103K「硬核」题,让大模型突破数学推理瓶颈
现有大语言模型在数学推理训练时面临数据瓶颈,腾讯AI Lab与上海交大团队推出DeepMath - 103K数据集。它规模大、难度高、数据新颖、严格去污染,让DeepMath系列模型达SOTA,还能实现推理泛化。
文心新出的推理大模型,给了我们信心
在 WAVE SUMMIT 2025 大会上,百度发布文心大模型 X1.1,是 X1 升级版,发布即上线可免费体验。它在事实性、指令遵循、智能体等能力显著提升,全方位测评表现出色,还开源新模型,展现百度全栈 AI 实力。
黄仁勋CES放出大杀器:下一代Rubin架构推理成本降10倍
在CES 2026展上,英伟达黄仁勋介绍多项进展。下一代Rubin平台含六款芯片,推理成本降10倍;发布Alpamayo 1开源模型助力自动驾驶;还推出物理AI新模型等,携手伙伴展示机器人。
刚刚!Thinking Machines Lab | 长文揭开LLM推理不确定性真相!
Thinking Machines Lab发布《克服LLM推理中的不确定性》,揭示大语言模型推理不确定性原因,并非“并发 + 浮点”假设那么简单,主要是负载及batch size不确定所致,还给出让核函数有批次不变性的方法及实验结果。