推理数据」共找到 4180 篇相关文章

算法论文8

综述 | 从“说出来”到“脑中算”:Latent Reasoning的范式跃迁与无限可能

大型语言模型用显式思维链推理有局限,潜在思维链(Latent CoT)让推理在连续隐藏状态空间进行。论文梳理该领域,建立框架,介绍方法,探讨可解释性与无限深度推理,指出价值、挑战与未来方向。

深度学习自然语言处理
新闻资讯7

OpenAI不Open!7年功勋老将投奔宿敌,实验室沦为API代工厂

2026开年,OpenAI的「推理之父」Jerry Tworek离职,他入职近七年,是推理技术核心人物。Scaling Laws失效,后训练成主要出路,但深度推理成本高,在强调盈利环境下,Tworek不满研究受限而离开,OpenAI或失去通往AGI的机会。

新智元
算法论文8

AI哪怕答案正确,逻辑链却惨不忍睹,奥数级不等式证明成功率不到50%| 斯坦福&伯克利&MIT

斯坦福、伯克利、MIT等联合研究,系统评估29个大模型在奥数级不等式证明任务的能力。研究发现,模型答案正确多靠猜,推理漏洞多,参数大、思考久也不能提升推理严谨度,但自我反思和定理线索策略有改善效果。

量子位
新闻资讯7

哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型

GPT之父Alec Radford等用1931年前数据训练13B模型Talkie,切断现代知识污染。研究者测试其能力,探讨它对未来的“预感”、规避污染问题及数据多样性等,同时训练中也面临时间泄漏、数据质量等难题。

机器之心
开源动态8

WRC整理床铺机器人背后模型曝光!端到端双系统全身智能VLA,仅凭少量微调就能get任务

星海图在2025WRC展示G0模型,可让机器人自主完成铺床任务。其发布端到端双系统全身智能VLA模型G0,结合真机数据集与架构,还构建开放数据集,评测结果优于π0模型,即将开源。

量子位
算法论文8

大模型听懂语音却反而变笨?港中深与微软联合解决语音大模型降智问题

从GPT - 4o开启全能交互时代后,Speech LLM面临“模态推理鸿沟”问题,输入从文本变语音,推理能力显著衰退。港中深与微软联合提出TARS框架,通过三项创新解决此问题,实验显示推理能力100%复原。

机器之心
新闻资讯7

给机器人打工了一天,我们体验上了AI时代最魔幻的工作。

本文讲述作者公司小伙伴达达体验给具身智能做数据采集工作的经历。具身智能数据获取难,催生数据采集员岗位。达达面试顺利,工作时先觉新奇,后感手腕酸,日薪200 - 250元,凸显AI进步背后普通人的贡献。

数字生命卡兹克
开源动态7

DeepSeek V3.1 把 R1 融了,一堆新活:<think>开关、动态搜索、新ToolCall ...

DeepSeek在Hugging Face悄悄发布V3.1版本,将对话和推理模型合并为混合推理模型。它有显式推理、内置搜索、简化工具调用等特性,Aider测试成绩佳且成本低,但也存在战术回避、幻觉率升高等问题。

探索AGI
新闻资讯7

比起让大模型写 100 万字的小说,AI 大牛们更想用 AI 拿诺贝尔奖

OpenAI前CPO Kevin Weil创业,新公司定位是“为AI模型收集科学数据”的平台,估值达7.5亿美元。AI4S赛道成为硅谷离职AI高管热门去向,正从概念叙事进入基础设施建设阶段,包括数据、模型、应用层。

AI科技评论
开源动态8

Meta联手UCSD发布DeepConf:计算成本暴降85%,99.9%准确率!

Meta AI联合UCSD推出DeepConf技术,解决了AI高难度推理准确率与计算成本的难题。它让AI学会“察言观色”,筛选靠谱推理路径,在AIME 2025竞赛中与GPT - OSS - 120B模型取得99.9%准确率,还节省大量计算资源。

AIGC开放社区