对抗协作学习」共找到 1879 篇相关文章

开源动态8

Agent 自我改进的六条路

文章梳理了让 AI Agent 不重新训练就能变强的六种机制,包括输出自审、持久记忆、进化搜索、对抗训练、自我修改和编排自优化,介绍了各机制代表项目及成果,指出 AI 学习正从训练溢出到部署阶段。

AGI Hunt
6

增长密码:大型网站百万流量运营之道

本书深入探讨了大型网站SEO的底层逻辑,从系统能力、协作能力到创新能力,通过作者亲自操盘的成功案例,揭示了大型网站流量增长的秘诀。书中不仅分享了零成本获客的策略,还涵盖了被动式营销的要领,让读者能够快速掌握SEO的核心技巧。

胡勇
产品应用8

Claude Code 史诗级更新!AI 编程进入“反向教学”模式,写到一半会停下考你:这行代码你来写

Claude Code和Claude App推出学习模式,Claude Code支持用`/output-style`定制沟通风格,有Default、Explanatory、Learning三种内置风格,还能自定义,Claude App的Learning风格也全面开放。

AI寒武纪
新闻资讯7

Claude1.7万字系统提示词全网刷屏!Karpathy锐评:LLM训练缺乏关键范式

Claude近1.7万字系统提示词在GitHub泄露,网友称是提示技术的金矿。大神卡帕西提出系统提示学习新范式,模拟人类经验积累,让LLM有‘记忆’功能,引发网友激烈讨论。

量子位
算法论文8

一个指令误导智能模型!北航等首创3D语义攻击框架,成功率暴涨119%

北京航空航天大学与中关村实验室团队提出全新框架InSUR,入选NeurIPS 2025。该框架可基于指令生成对抗样本,首次实现3D SemanticAE生成,从采样、建模、评估三方面突破,实验验证其有效性与可扩展性。

量子位
新闻资讯8

汪军对话 Rich Sutton:大模型在一定程度上分散了我们对智能理解的注意力

在RL China 2025开幕式上,汪军与图灵奖得主Richard Sutton对话。Richard认为大模型缺乏目标和奖励,分散对智能理解的注意力。他强调RL核心是从经验学习,智能原则含梯度下降等,建议将目标解读为“奖励”。

AI科技评论
开源动态7

单Agent时代结束,AI们开始组团上班

月之暗面发布并开源K2.6,重点升级代码能力与多Agent协作的“Agent集群”能力。K2.6在Artificial Analysis上取得全球开源第一,实测能并行交付多格式成果,还展现出强大的全栈应用开发能力。

量子位
推荐文章8

Pokee.ai 朱哲清:用 RL 搭建智能体的「骨骼与神经」| AI 产品十人谈

《AI 产品十人谈》对话 Pokee.ai 朱哲清,探讨强化学习与 Agent。朱哲清是强化学习信徒,曾带领 Meta 团队突围。他认为单靠预测难完成复杂任务,强化学习是超人类智能的关键,介绍了 Pokee.ai 产品优势及对通用 Agent 的看法。

AI科技评论
开源动态8

陶哲轩重写20年本科经典教材!Lean编程数学证明,GitHub已放出

陶哲轩迷上形式化数学证明,开设YouTube账号分享用Lean形式化证明的视频,还发布开源项目,将经典教材《Analysis I》定义、定理和习题「翻译」成Lean代码,项目可作学习资料,部分内容已完成翻译。

新智元
产品应用7

秘塔 AI,悄咪咪上线「今天学点啥」App

作者受手机厂商将AI功能做成NFC卡片启发,提出把知识载体变成Agent的想法。秘塔AI观点与其不谋而合,还将「今天学点啥」做成独立App,可个性化学习,体验超预期。

特工宇宙