算法进化框架」共找到 2633 篇相关文章

算法论文8

高效智能体的「幕后推手」是谁?一篇综述带你从记忆×工具学习×规划看透

随着大模型能力提升,业界关注智能体落地,而高效性是决定能否上线的‘硬’问题。论文梳理‘高效智能体’综述,从记忆、工具学习、规划三机制出发,还谈及基准评测、挑战与展望。

机器之心
新闻资讯7

破防了!全球顶尖AI惨败,人类最后防线竟是「重启试试」?

GSMA联合权威组织发起全球电信AI故障排查挑战赛,吸引超1000支队伍。赛事依托权威评估框架,设丰厚奖励,分多个赛道,还将开展智能体任务,预示电信运营模式重构。

新智元
算法论文8

人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练

人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。

AI科技评论
算法论文8

LLM 竟然会内省!Anthropic 整了个大活:首次揭开 AI 意识

Anthropic最新研究《大语言模型中涌现的内省意识》,首次通过直接操控模型内部状态验证AI能否觉察自己思想。研究采用概念注入技术,发现AI有内省能力,且不同模型表现有差异。

PaperAgent
算法论文8

高保真、多控制集成于「统一画布」,组合式图像生成新范式!

Canvas - to - Image是新型图像生成框架,将多种控制方式整合到统一画布,用户可直观操作生成高保真、多控制图像。它简化创作流程,解决了现有方法控制单一分散、交互性差的问题。

新智元
算法论文8

RL是「点金石」还是「挖掘机」?CMU 用可控实验给出答案

卡耐基梅隆大学研究者构建基于GSM - Infinite的可控合成数据框架,分析预训练、中期训练和RL对模型推理泛化能力的影响,调和了RL有效性的不同观点,为改进训练策略提供基础。

机器之心
新闻资讯8

千丁数科魏振华:企业AI落地“六步法”|甲子引力

2025年12月3日,千丁数科COO兼首席科学家魏振华在甲子引力年终盛典上,结合龙湖数字化沉淀与实践,复盘企业AI落地。他提出“六步法”,并展示六大场景数据,为传统行业智能化转型提供参考。

甲子光年
新闻资讯8

为什么所有企业都在谈 Agent?50+ 技术实践给出真实答案

12月19 - 20日北京举办的AICon全球人工智能开发与应用大会,聚焦AI Agent等关键方向。来自腾讯等企业的实践者将分享构建智能系统经验,大会设Keynote和12大平行技术专场,呈现AI技术全景。

PaperAgent
算法论文8

为什么 LLM 搞不定复杂任务?ReAct 与 Reflexion 技术综述

文章指出大语言模型处理复杂任务存在事实幻觉、缺乏实时信息等问题。介绍ReAct将推理和行动结合,及Reflexion在其基础上添加评估反思机制,探讨两者结合优势,还提及未来发展方向。

阿里云开发者
推荐文章7

大小模型协同架构在金融智能投顾中的应用与挑战

本文整理自北银金科高级算法专家尹辰轩分享,介绍大小模型协同架构下的大模型投顾方案,能解决幻觉问题、优化回答深度。还提到 12 月 19 - 20 日 AICon 北京站聚焦多热门方向。

InfoQ