不对称训练」共找到 3306 篇相关文章

新闻资讯7

谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。

Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止有害行为。

探索AGI
开源动态8

愁了!开源智能体Paper2Poster「一键生成」学术海报

2025年5月,滑铁卢大学等团队发布Paper2Poster系统,用大模型将论文自动生海报。它提出PosterAgent多智能体方法,分解析、规划、绘制优化三阶段,生成效果好且开源,过也存在效率和创意足问题。

机器之心
算法论文7

无需训练!让VLM同时具备「视觉」与「推理」能力,数学题得分暴涨30%

当前视觉语言模型(VLM)像‘视力好但数学差的学生’,论文指出问题根源是数据足和能力分布均。提出‘模型合并’方案,实验显示在数学基准测试中表现亮眼,还通过实验揭示层间能力分布。

深度学习自然语言处理
6

小学生都买奔驰宝马了,你还来玩《汽车大亨2》?

产品应用8

拆解 Claude 5.1:38 小时睡觉的背后,Anthropic 正在终结「模型论」

Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还体现了能力权限分离等变化。

AI科技评论
新闻资讯7

OpenAI搬空Claude Code!用户家当一键进Codex,唯独带走Claude

AI编程大战中,OpenAI盯上对手用户的配置、技能等“家当”。8月11日其统一外部智能体导入说明,可将Claude Code等工具配置等搬入Codex,但只能进能出,且部分内容无法迁移。

新智元
新闻资讯8

人类56年解出,谷歌AI一夜连破9道世纪难题!

Google DeepMind发布全新AI数学智能体AlphaProof Nexus,一次性攻克9道悬而未决几十年的Erdős开放问题,最老的已悬置56年。证明经Lean编译器验证,无错误可能。此外,还在多数学分支取得突破。

新智元
新闻资讯8

换GPU,性能飙升2.8倍!英伟达用软件暴打摩尔定律

2026年1月8日,英伟达官网披露,基于Blackwell架构的推理软件栈升级,让混合专家模型(MoE)推理效率迎「阶跃式」突破,单GPU吞吐飙升2.8倍,显著降低推理成本。其通过软件针对性升级发挥硬件潜力,还进行多项优化。

新智元
开源动态8

300个AI员工,跑满4000步崩,Kimi新一代模型K2.6来了

月之暗面开源发布 Kimi K2.6 模型,在通用智能体、代码编写和视觉理解等综合能力上全面跃升。它在多项测试成绩领先,能连续工作13小时,还在全栈开发、多智能体协作等方面有出色表现。

AIGC开放社区
算法论文7

人多管用!智能体团队别盲目扩张,最新综述给出三大维度

随着大语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩大后会失稳、低效。美国、英国和澳大利亚研究人员提出三维分类框架描述大规模智能体网络,指出真正决定系统表现的是三种机制组合。

新智元