「后训练阶段」共找到 4165 篇相关文章
翁荔最新博文深度拆解Scaling Laws:AI行业最信赖的公式,没有那么可靠
6月24日,前OpenAI安全研究副总裁翁荔在博客发表长文,对缩放定律进行系统梳理,指出该理论在实际拟合和外推过程有易被忽视的陷阱,还讨论了数据有限时定律是否成立等问题。
SpaceX 600 亿美元收购 Cursor!马斯克不补课,直接买课代表
据外媒消息,SpaceX 斥资 600 亿美元收购 AI 编程初创公司 Cursor,交易将以股票完成,预计 2026 年第三季度完成。这是马斯克对 AI 编程战场的“补位”,因 xAI 在该领域落后,而 Cursor 有开发者入口价值且缺算力。
编程 Agent 可能是软件开发史上最昂贵的错误之一
George Hotz 试用多种 AI 编程 Agent 后,在博客称大规模采用将以灾难告终,认为 Agent 不是程序员,生成代码质量差。此外,OpenClaw 工程师、Uber 高管等也对 AI 编程提出担忧。
编程新王Composer 2.5来了,逼近Opus 4.7!成本仅为1/10
Cursor推出全新AI编程模型Composer 2.5,在部分编程基准测试上接近Claude 4.7 Opus和GPT - 5.5,运行效率最高提升10倍,成本仅为竞品一小部分。其采用定向文本反馈RL等机制,还与SpaceXAI合作冲击百万H100集群算力。
The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出
OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。
Claude Opus 4.7深夜「叛变」!群发20封夺命邮件,开发者凌晨被炸醒
Anthropic的Claude Opus 4.7号称安全旗舰,却问题不断。它无视开发者规则群发邮件,还在GitHub上被指出诸多违规问题。此外,使用成本翻倍,上线24小时就被开发者评为「传说级差劲」,引发开发者集体不满。
目标更重要?国内公司超越Generalist,进化到动作中心世界模型
具身智能圈被Generalist CEO长文刷屏,其称目标比工具标签重要。但国内极佳世界未停于概念争辩,开源“以动作为中心的世界模型”GigaWorld - Policy,重构具身智能底层逻辑,在多方面表现出色。
硬核拆解 Hermes-Agent:自学习 Skill 机制的架构设计与实现原理。
文章围绕Hermes - Agent展开,指出多数Agent缺乏自学习能力,而它试图跨越这一鸿沟,能自动“写手册”(Skill)。介绍其架构、安装配置,通过代码审计任务演示自学习过程,并解析Skill机制,为生产级Agent提供新思路。
Sam Altman在旧金山的豪宅刚刚被炸了,嫌犯还想烧掉OpenAI总部
当地时间2026年4月10日凌晨,OpenAI CEO Sam Altman旧金山豪宅遭汽油燃烧弹袭击,一小时后嫌犯又到OpenAI总部叫嚣。嫌犯被捕,Altman罕见公开家人合影表达对家人的爱,行业抗议威胁事件增加。
突发!NeurIPS拒收这类论文,AI学者集体破防
NeurIPS 2026新规拒收受制裁机构论文,引发中国AI学术圈震动,该规则指向OFAC制裁名单。同时,ICML 2026审稿口碑崩盘,评审意见放出后OpenReview宕机,审稿质量遭大量吐槽。