双模式推理」共找到 2617 篇相关文章

算法论文8

AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型

文本提示图像分割技术有战略意义,但基于监督微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。

机器之心
算法论文8

句子级溯源+生成归因,C²-Cite重塑大模型可信度

在人工智能发展背景下,大模型内容可信度成焦点。北邮百家AI与小米团队提出溯源大模型C² - Cite,首创上下文感知归因生成技术,解决现有归因模型缺陷,已被WSDM 2026收录。

机器之心
新闻资讯8

强化学习教父重出江湖, 生成AI的时代要结束了?

新智元报道,强化学习之父Richard Sutton称GenAI时代正结束。他加入ExperienceFlow.AI,要让AI靠「经验」觉醒。该公司定位打造「经验驱动的去中心化超级智能」,认为AI下一阶段应从世界中学习。

新智元
算法论文8

苹果掀桌!扔掉AlphaFold核心模块,开启蛋白折叠「生成AI」时代

蛋白质折叠是计算生物学核心难题,SimpleFold作为首个仅基于通用Transformer模块的蛋白折叠模型,摒弃AlphaFold2系列传统架构,能将蛋白序列生成三维原子结构,在多基准测试表现强劲,还可生成结构集合。

新智元
7

Agentic Enterprise:生成软件重新定义企业形态|AGIX PM Notes

文章指出软件正从静态代码集合变为“Living Software”,企业是其理想训练环境。还提及市场资金流向、多起企业投资合作事件,如英伟达投资英特尔、OpenAI租服务器等,最后介绍了ETF流动性相关知识。

海外独角兽
开源动态8

模仿人类推理修正过程,阶跃星辰提出形化证明新范 | 开源

阶跃星辰发布并开源形化定理证明大模型 StepFun-Prover-Preview-7B 和 32B。采用两阶段监督微调、工具集成强化学习及 RL 与 SFT 迭代循环优化等策略,在基准测试集表现佳,还展示多个证明案例。

量子位
新闻资讯7

Claude两个新模型实测流出!空间推理封神,算力直接榨干了

Claude两款新模型“棉花糖”和“甜瓜”实测流出,在3D强化学习和建筑空间布局上性能强大,还能直接理解并生成复杂3D坐标和空间关系。它们对算力吞噬疯狂,引发对其身份的猜测。

新智元
算法论文8

强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升

人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。

量子位
产品应用8

将DSA注意力引入多模态,快手Keye2.0开启强化推理新范

快手发布新版多模态大模型Keye-VL-2.0-30B-A3B,率先将DSA机制引入多模态理解场景,解锁256K超长上下文深度感知,还首次解锁Agent协作机制。该模型在多方面表现出色,且将融入业务带来收益。

量子位
算法论文8

四足机器人首次同时「思考+走路」,北大提出链推理MobileVLA-R1

在「大模型+机器人」浪潮中,让机器人既听懂话又走得对、稳很难。北大MobileVLA - R1将链思考引入四足机器人,在仿真和真实实验中对标强基线实现提升,构建了更具工程可用性的范

新智元