Reasoning新范式」共找到 4083 篇相关文章

新闻资讯7

OpenAI 的“编程”范式?其实是瀑布模型的回魂:“听 PM 的话、写需求文档”

在今年AI工程师大会上,OpenAI研究员Sean Grove提出在AI驱动时代,清晰规范将取代传统代码成软件开发核心产物。他认为编程核心是结构化沟通,该转变是工程实践未来方向,但引发诸多讨论。

InfoQ
算法论文8

强化学习也能预训练?效果可提升20倍,华人作引爆RL范式!

伯克利团队提出方法InFOM,不依赖奖励信号,能在多任务中超强迁移与推理。在36个基于状态和4个基于图像的任务测试中,InFOM表现出色,在jaco任务上改进达20倍。

新智元
开源动态8

突破传统检索瓶颈!阿里通义实验室发布 WebDancer,开启多步推理智能体范式!

在信息爆炸时代,传统检索技术缺乏动态决策能力,难以满足多步推理需求。阿里通义实验室发布的 WebDancer 基于 ReAct 框架,通过四阶段构建,在测试中表现优异,未来规划拓展工具生态、突破任务边界等。

开源星探
推荐文章8

Agent 时代启示录: 当 Agent 作为物种加入经济系统

文章指出 Agent 时代正颠覆传统互联网分析框架,如 To B/To C 边界模糊、付费逻辑转变等。软件形态也在重写,Agent 成物种加入经济系统,还探讨了 Agent Harness 商业机会,如 Runtime、Context、Orchestration 层。

海外独角兽
算法论文8

改变强化学习范式,Meta作呼应Sutton「经验时代」预言

图灵奖得主等提出AI智能体将迎「经验时代」,但训练面临挑战。Meta研究用「早期经验」范式解决问题,包含隐式世界建模和自我反思,提升了智能体任务成功率和泛化能力。

机器之心
新闻资讯7

LangChain 完成一轮融资,估值达 12.5 亿美元

LangChain 宣布完成一轮融资,估值达 12.5 亿美元,由多家知名投资机构参与。它从单一 Python 包发展为综合性平台,产品矩阵丰富,客户众多。融资同时发布多项产品更,资金用于产品和平台建设。

AI工程化
产品应用7

“龙虾”也需要看病?一张旧病历,引出三个确诊

本文是悟空Agent泛化能力系列先导篇,以OpenClaw项目为例,介绍其通过不同泛化策略发现三个漏洞,还总结实践原则。强调研究泛化能力对防御漏洞的重要性,4月底悟空Agent将开放试用。

腾讯技术工程
算法论文8

强化学习大本营作:如何破解「学忘旧」困局

阿尔伯塔大学强化学习团队提出FAME框架,解决持续强化学习“学忘旧”问题。团队先定义基础概念,将知识整合写成优化问题,再受人类学习机制启发设计FAME,实验优势明显。研究还探讨持续学习的产业价值。

AI科技评论
新闻资讯7

首创郎园成功举办AIGC视听产业人才生态大会

2025年首创郎园AIGC视听产业人才生态大会在北京举办,由多机构联合主办,众多高校、企业及嘉宾参与。大会聚焦构建产业‘星探’平台,展示成果、成立矩阵、发布资源包、启动大赛等,推动人才与产业对接。

郎园Station
新闻资讯7

Kimi模型数学反超DeepSeek!北大校友刘征瀛等领衔

Kimi定理证明模型超越DeepSeek,基于Qwen2.5 - 72B打造,采用Kimi k1.5强化学习训练流程。有两大技术创,还有精简版本,官方有Demo。双方此前比赛就打得有来有回。

量子位