「多智能体学习算法」共找到 4803 篇相关文章
地球级AI智能体爆诞!谷歌地球开外挂,一夜为20亿人洪水预警
谷歌结合世界建模经验与Gemini推理能力,升级Earth AI。它是地理空间AI模型和数据集,可自动连接不同地球AI模型。谷歌还推出新成果,如新一代影像与人口基础模型、空间推理智能体,可用于灾害预警等。
阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理大模型
LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理的模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。
国庆这8天,我发现和AI辩论才是最高效的学习方式。
作者国庆假期与AI辩论,以自身关于AI时代信息筛选的观点为例,阐述和AI辩论是高效学习方式。先提出观点,后与AI多轮交锋,过程虽痛苦但能促使人思考、完善观点,还给出与AI辩论三步法。
让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源
清华AIR、字节联合团队曾发布DAPO实现大规模LLM强化学习。刘力源、姚峰团队发现DAPO-32B中rollout生成是瓶颈,推出FlashRL,应用INT8/FP8,用TIS解决不匹配问题,加速显著且不牺牲性能,一条命令即可使用。
Claude推出多智能体代码审查系统:Anthropic内部同款,接管PR深度抓Bug
Anthropic为Claude Code引入代码审查系统,复刻内部审查机制,调度多智能体揪深层Bug。该功能面向团队和企业版用户预览,审查更彻底,虽成本高但有效提升审查质量,还能自定义规则、管控成本。
IJCAI-ECAI 2026 开幕:吴佳俊斩获「计算机与思想奖」,SMOTE 算法获首届时间检验奖
当地时间2026年8月18日,第35届国际人工智能联合会议(IJCAI - ECAI 2026)在德国不莱梅开幕。会上颁发多项大奖,如吴佳俊获“计算机与思想奖”,SMOTE算法获首届时间检验奖,还公布论文接收数据,推出早期职业焦点演讲。
算法1年翻倍,芯片2年翻倍?重磅实锤:AI正在自我加速,拦不住了
NBER论文证明AI研发自我加速反馈环强度远超其他科技领域,芯片效率每2年、算法效率每1年翻倍。部分自动化就能引爆反馈环,全行业13%自动化率或软硬件17%自动化率可触发奇点,6年内AI可能实现自我迭代。
从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用
近年来大语言模型在长篇视觉叙事中潜力卓越,但长视频剪辑仍难控制。中科大等团队开源工作从系统工程视角研究多模态智能体在长视频编辑中的机制,重构剪辑管线,找到症结并给出解决办法。
不让“猪队友”拖后腿!哈深新作 AgentDropoutV2,专治多智能体“传话游戏”翻车现场
多智能体系统中,常有agent出错带偏整体。哈工大联合阿里提出AgentDropoutV2,测试时介入,设‘质检员’审核输出,结合失败案例构建‘避坑指南’,在多测试中显著提效,泛化性强。
手机AGI助手还有多远?移动智能体复合长程任务测试基准与调度系统发布
上海交大与澜舟科技研究发现现有移动端GUI智能体处理复合长程任务能力不足,提出UI - Nexus测试基准和Agent - NEXUS调度系统,经实验能提升任务完成率,也为AI原生操作系统建立雏形。