多模型 Agent」共找到 10765 篇相关文章

算法论文8

东南大学耿新团队:模型不是不会做,而是被「挤掉了能力」丨CVPR 2026

东南大学耿新团队针对模型任务融合问题提出论文《Model Merging in the Essential Subspace》。指出任务融合失败源于关键方向重叠冲突,提出 ESM 方法,能让不同任务在模型中稳定共存,实验显示其性能更优。

AI科技评论
产品应用7

两周干成一天!毕马威用100页Prompt落地企业Agent

毕马威打造税务AI助手TaxBot,将两周的专业咨询工作缩至一天,效率提升超10倍。其构建KPMG Workbench平台,集成模型,用100页Prompt指导学习,未来或采用Agent Runtime服务。

探索AGI
开源动态8

首个开源模态Deep Research智能体,超越个闭源方案

首个开源模态Deep Research Agent登场,整合种工具并优化决策。其WebWatcher技术方案覆盖全链路,实验中在四大核心领域领先主流模型,展现复杂推理和信息检索实力。

量子位
推荐文章8

给野马套上缰绳:Agent Harness 工程实践 ——从范式理论到钉钉AI招聘的真实落地

本文围绕 Agent Harness 工程实践展开,指出瓶颈在‘装’好模型而非模型本身。介绍 Agent 公式、范式跃迁、四条铁律、工程模式,以悟空 AI 招聘为例说明落地,还分析行业标杆、未来趋势,给出心法。

阿里云开发者
算法论文8

ICML 2026 | Agentic强化学习训练的信息自锁问题

随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在场景实验中表现稳定且具鲁棒性。

机器之心
产品应用7

6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

过去大模型生成的游戏虽代码能跑,但常陷入“可玩性黑洞”。Spellcaster让个专用Agent协同处理,形成“生成—运行—检查—修复”循环。目前能快速生成种游戏原型,未来将用世界模型直接生成画面。

量子位
算法论文8

斯坦福提出新的RL范式,让3B模型Agent超越Claude、GPT-4

斯坦福提出新的RL范式,让小模型Qwen2.5 - 3B经训练后性能超越Claude - 3.5 - Sonnet等大模型。论文解决了RL在代理环境中可变时长动作优化偏差和稀疏奖励两大挑战,为AI代理发展指明方向。

深度学习自然语言处理
算法论文8

NeurIPS 2025 Spotlight | 让检索、推理真正「合体」的小而强模型,AceSearcher来了

近期,所高校研究团队发布 AceSearcher 模型,它是让同一语言模型在推理时兼任双角色的合作式自博弈框架,以两阶段训练为骨架,将推理与检索结合,提升复杂检索任务效果,在任务上表现出色。

机器之心
算法论文8

混合数学编程逻辑数据,一次性提升AI领域强化学习能力 | 上海AI Lab

上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在领域推理机制。构建领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有项关键发现,为构建AI推理模型提供参考。

量子位
产品应用8

超脑未来WorldDreamer V4横扫个权威榜单,世界模型进入群体智能时代

超脑未来发布 WorldDreamer V4,它以智能体为基本单位,具种核心能力。采用新预训练架构,引入 Masked Agent Modeling,用共享隐式世界状态带来新协同范式,还在权威榜单领先。

机器之心