不对称训练」共找到 3320 篇相关文章

算法论文8

让GUI Agent再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务

手机GUI Agent在长程任务中易遗忘关键信息,浙江大学APRIL实验室和快手主站技术部提出MemGUI - Agent,核心是ConAct,将上下文管理变为Agent动作,还开源MemGUI - 3K数据集,模型在评测基准取得佳绩。

量子位
推荐文章8

Codex 负责人:「所有人都是 builder」是个很糟糕的主意

OpenAI Codex 团队负责人 Andrew Ambrosino 认为,AI 时代产品开发各环节发生变化,实现成本降低,品味变得更重要。他还谈到岗位角色融合但 PM 会消失,以及 Codex 发布时机和工作模式等问题。

Founder Park
算法论文8

邢波再出手:上次「骂」完世界模型,这次轮到智能体了

邢波教授新作《智能体模型批评》上线 arXiv,质疑当下被称为「智能体」的系统是否名副其实。论文将其分为两类,沿五维度拆解主流设计,提出 GIC 架构,还探讨了安全问题,指出要让能力内化进模型。

机器之心
算法论文7

一篇Loop+Harness的自进化Agent最新综述

本文分享清华关于经验时代,已部署的 Agent 如何将交互轨迹转化为持久能力,从自我进化到元进化的论文。介绍了 Harness、技能、记忆、环境等方面,还提及 RL 与持续学习、元进化智能体等内容。

PaperAgent
新闻资讯7

刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但一定更便宜

Anthropic发布Claude Sonnet 5,称其为最具Agent属性的Sonnet模型。它在推理等方面性能提升,接近Opus 4.8且价格低。安全评估有改善,但网络安全逊于Opus 4.8。已正式可用,有优惠首发价。

机器之心
推荐文章8

翁荔最新博文深度拆解Scaling Laws:AI行业最信赖的公式,没有那么可靠

6月24日,前OpenAI安全研究副总裁翁荔在博客发表长文,对缩放定律进行系统梳理,指出该理论在实际拟合和外推过程有易被忽视的陷阱,还讨论了数据有限时定律是否成立等问题。

DeepTech深科技
新闻资讯7

「硬创 Conclave」邀请函丨15人闭门局,聊透消费级家庭机器人的真问题

雷峰网硬创邦与山行资本联合发起消费级家庭机器人闭门会,探讨刚需真伪、端侧算力等真问题。活动遵循直播等原则,2026年6月25日举办,限15人,需审核报名。

AI科技评论
开源动态8

真可用!美团数字人模型开源,MV、电商等统统拿下

美团开源数字人视频生成框架 LongCat - Video - Avatar 1.5 版本,换音频编码器、加速推理,支持多任务与多场景。经770人评测,它在多维度领先对手,各方面表现均衡,效率与质量兼得。

AIGC开放社区
产品应用8

编程新王Composer 2.5来了,逼近Opus 4.7!成本仅为1/10

Cursor推出全新AI编程模型Composer 2.5,在部分编程基准测试上接近Claude 4.7 Opus和GPT - 5.5,运行效率最高提升10倍,成本仅为竞品一小部分。其采用定向文本反馈RL等机制,还与SpaceXAI合作冲击百万H100集群算力。

新智元
算法论文8

WWW'26 | 跨任务自适应的Multi-Agent协作新范式

大型语言模型驱动的多智能体系统成解决复杂任务重要范式,但智能体协作存在关键问题。Griffith和西北农林科技大学团队提出OFA - MAS,将多智能体拓扑设计从one - for - one推向one - for - all,实验效果佳。

PaperAgent