AI推理能力」共找到 11842 篇相关文章

算法论文8

RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能

普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。

机器之心
推荐文章8

吴恩达来信:AI 技能正在重新定义优秀开发者的标准

吴恩达指出市场对懂 AI 的开发者需求大,应届生失业率上升。面试看重利用 AI 辅助开发等能力,具备这些技能的人效率远超传统开发者,AI 工程正掀起变革,基础与 AI 知识结合造就高效开发者。

DeeplearningAI
7

AI写论文,AI评阅!AI顶会ICLR完成「AI闭环」,1/5审稿意见纯AI给出

在号称「史上最严管控AI」的顶级会议ICLR 2026上,超五分之一审稿意见由大模型一键生成。这发生在ICLR颁布史上最严LLM规定后不久,引发诸多争议,也凸显AI改写科学评审分工的趋势。

新智元
开源动态8

上海AI实验室造出首个「通才」机器人大脑:看懂世界+空间推理+精准操控全拿下

上海人工智能实验室联合多家单位提出通用具身智能大脑框架VeBrain,能集成视觉感知、空间推理和机器人控制能力。它统一三类任务语言建模范式,有“机器人适配器”,配套VeBrain - 600k数据集,性能测试表现出色。

量子位
算法论文8

两个LLM互相对线,推理能力起飞:康奈尔团队发布大模型版类GAN训练法

康奈尔大学团队提出面向大语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在多模型实验中显著提升数学基准表现,不过在部分领域外任务有局限。

机器之心
开源动态8

Spring AI Alibaba 1.0 GA 正式发布,Java智能体开发进入新时代

2025年AI智能体爆发,Java智能体构建需求激增。Spring AI Alibaba 1.0发布,是基于Spring AIAI框架,提供多智能体框架、生态集成等核心能力,助力Java智能体开发,还规划了持续迭代、可观测评估等功能。

阿里云开发者
开源动态8

打破AI能力的惯性评估方式,红杉中国推出全新双轨基准测试xbench|甲子光年

红杉中国推出全新AI基准测试工具xbench,采用双轨评估体系,构建多维度测评数据集,追踪模型理论能力上限与Agent实际落地价值。还采用长青评估机制,首期发布两个核心评估集并给出综合排名,公开后邀各界完善。

甲子光年
开源动态8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5,提供长文本推理后训练“配方”,含数据合成管线、强化学习方法和智能体架构。通过三大“法宝”重塑模型能力,效果显著,相关代码已开源。

AINLPer
算法论文8

Auto Research时代,47个没有标准答案的任务成了Agent能力必测榜

Einsia AI旗下Navers lab发布Agent Benchmark——Frontier-Eng Bench,让AI在47个多学科交叉的硬核任务中做工程优化,测试其迭代优化能力。研究总结出AI进化规律,初步勾勒接近真实工程循环的AI系统。

量子位
产品应用8

一文读懂鲸智百应:驱动组织进化的企业AI操作系统,让企业从「用AI」到「是AI

在2025云栖大会上,浩鲸科技推出「鲸智百应」企业AI操作系统。它从六大维度让企业成「AI原生组织」,如统一认知搭建底座、智能执行让AI成主力等,助力企业解决AI应用根本问题。

机器之心