自进化能力」共找到 4383 篇相关文章

算法论文8

首个测试时共进化合成框架TTCS:在「左右互搏」中突破推理瓶颈

厦门大学DeepLIT课题组提出全新测试时课程合成框架TTCS,不依赖外部标注,通过生成器与求解器共进化博弈合成课程数据,解决测试样本过难导致的训练坍塌问题,实验显示其推理能力提升显著。

机器之心
新闻资讯7

GPT-5.4 发布,OpenClaw 要被替代?OpenAI 新模型会己用电脑了,还顺手把编程能力拉满

今天,OpenAI 发布 GPT-5.4,将推理、编程和计算机使用能力整合,具备原生电脑操作能力,提升了工具使用效率。它成本降低、幻觉减少、编程能力更强,但 API 价格较高。其或与 OpenClaw 抢夺入口。

InfoQ
算法论文8

一篇19种进化Agent Skill框架最新综述

这篇来Rutgers大学和UNC Charlotte的survey,首次系统梳理Agent技能的进化与评估全貌,覆盖19种技能进化方法和10个评估基准。指出当前评估体系有诸多不足,如无法追踪技能多轮反馈后是否变好等。

PaperAgent
算法论文7

无需外部数据!AI答实现推理能力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。

量子位
算法论文8

AI学会左脚踩右脚进化?Meta华人新研究改写Agent法则

Meta华人学者Jenny Zhang联合多机构研究者提出新智能体框架HyperAgents(DGM - H)。它打破任务能力我改进能力需对齐的局限,能跨任务我改进,还动生成基础设施,或改写Agent竞争规则。

新智元
算法论文8

无需人工标注!AI生成训练数据,靠「演绎-归纳-溯因」解锁推理能力

新加坡国立大学等机构研究者提出元能力对齐训练框架,模仿人类推理心理学原理,将演绎、归纳与溯因能力融入模型训练。实验显示,该方法提升模型在多任务上的性能,且有跨领域可扩展性。

新智元
新闻资讯8

7个月翻一番!AI agent能力飙升,METR报告揭示指数级进化规律

非营利研究机构METR报告显示,Agent能力每7个月翻一番,这在9项基准测试中得到验证,任务涉及编程、数学等领域,大模型正迈向高度动化,且Agent性能提升快,未来处理复杂任务能力或更强。

量子位
推荐文章8

一篇讲透Agent进化飞轮怎么搭:评测→记忆→落地→控制

文章指出多数团队评测、记忆、Self - Improve 拆分做,飞轮难转,原因是环节衔接断链。基于行业研究及实践,提炼评测→记忆→落地→控制四齿飞轮方法论,阐述各环节核心矛盾、建设要点、避坑指南及咬合形成飞轮的方法。

腾讯技术工程
产品应用8

扩散语言模型写代码!速度比回归快10倍

Inception Labs推出基于扩散技术的大语言模型Mercury,它突破回归模型限制,生成速度快,还解决了难以回头调整的问题。实测显示其代码生成速度比传统工具最多快10倍,且有强大纠错能力,但面临与当前CI能力不匹配问题。

量子位
算法论文8

LLM 仅靠身就能增强推理?SePT 给出简洁在线训练范式

多数推理后训练方法依赖外部信号,SePT仅用模型身生成的答案训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。

机器之心