推理时纠错」共找到 2632 篇相关文章

新闻资讯8

刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来

OpenAI 十周年推出 GPT - 5.2 系列模型,包括 Instant、Thinking 和 Pro 版本。它在多方面表现出色,刷新多项基准测试 SOTA 水平,如 AIME 2025 获满分,在 GDPval 达人类专家水平。还在编码、视觉理解等能力上有显著提升。

机器之心
新闻资讯8

Gemini 首次反超 ChatGPT,谷歌CEO劈柴哥复盘:不止是十年算力与全栈豪赌,更是找回了“老谷歌”那个味儿

截至2025年底,Gemini在桌面和移动网页端单次使用平均停留长超ChatGPT,下载量也快速追赶。谷歌CEO Sundar Pichai称这是全栈投入成果,还提及早期谷歌文化回流,也谈到未来十年押注等内容。

InfoQ
算法论文8

“最强具身VLA大模型”,究竟强在哪儿?

机器人基础模型π*0.6刷屏,能让机器人高效完成多项任务。它引入Recap学习法,突破传统模仿模式。其核心方法RECAP让VLA用奖励反馈和人类介入训练,还能从异构数据学习,实现自我进化。

量子位
算法论文8

清华首提通用大模型滤波方法,实现零样本状态估计|NeurIPS'25

清华大学李升波教授团队在NeurIPS 2025提出LLM - Filter通用滤波器,将状态估计融入大语言模型推理框架。它能解决传统方法泛化性差问题,在未见过系统中实现零样本状态估计,有望成基础模型。

新智元
新闻资讯8

0.027B手机AI模型,估值2亿美金,三个清华学霸如何获得国际大学生创新大赛冠军

10月15日,清华万格智能团队“基于类脑架构的下一代通用模型与智能体生态”获中国国际大学生创新大赛(2025)冠军。团队由三个清华本科生创立,此前已完成融资,估值达2亿美元。其智人HRM模型有诸多优势,还研发出顶尖气候预测专家模型。

AIGC开放社区
算法论文8

基础模型已颠覆科研,进入第五范式!港科大综述113篇论文 | NeurIPS'25

港科大论文指出,随着科学问题复杂度提升,传统科研范式显露出局限。基础模型(FMs)横空出世,具备通用性、规模与知识覆盖、推理与生成能力,可能引领科学进入第五范式,但也面临偏见、幻觉等问题。

新智元
推荐文章8

大语言模型的解耦:人工智能基础设施的下一轮进化

人工智能模型发展快,但基础设施滞后,传统单体式服务器架构成瓶颈。文章介绍大语言模型推理的预填充与解码阶段差异,指出解耦架构可突破困境,还阐述其经济影响、实施策略、应用案例及未来展望。

InfoQ
新闻资讯7

Anthropic发布Agent SDK,截胡 OpenAI

OpenAI Agent Builder消息传开,大家等其Dev Day发布,Anthropic突然宣布将Claude Code SDK改名Claude Agent SDK,抢先发布完整智能体开发框架。该SDK有独特理念、工作流程及多种功能,与OpenAI产品理念不同。

AI工程化
产品应用8

AI改造出行体验:滴滴的试验能否开启行业范式转变?

滴滴近日面向公众内测上线出行AI助手小滴,颠覆传统打车模式。它能精准理解需求,提供个性化方案,还可进行推理和订单规划。滴滴用工程打法攻克难题,还上线MCP服务助开发者定制助手。

新智元
产品应用8

AI视频生成走向“演技生成”代,生数科技Vidu全球发布Vidu Q2 | 甲子光年

9月25日,生数科技全球上线新一代图生视频大模型Vidu Q2,实现从“视频生成”到“演技生成”跨越。它在表情生成、运镜、语义理解、长选择等方面有提升,分闪电和大片模式,已在多端上线。

甲子光年