「o1-preview」共找到 2059 篇相关文章
拆解 Claude 5.1:38 小时不睡觉的背后,Anthropic 正在终结「模型论」
Anthropic 更新 Claude 5.1,推出 Fable 5.1 和 Mythos 5.1,将‘智力’与‘权限’物理剥离。前者负责通用任务,后者面向专业场景。此次更新展示模型解决长时任务状态一致性等问题的能力,还体现了能力权限分离等变化。
离谱……面壁让 AI 写了个训练框架,然后它自己训出了最强的 1B 模型:MiniCPM5-1B
面壁发布 1B 参数量级最强端侧文本大模型 MiniCPM5 - 1B,其 Base Model 由 AI 编写的训练框架 ForgeTrain 训出,速度超英伟达 Megatron 10%。该模型性能出色,部署门槛低,数据治理方案对应数据集也已开源。
清库存!DeepSeek突然补全R1技术报告,训练路径首次详细公开
DeepSeek给近一年前登上《Nature》封面的R1论文补64页技术细节,正文大幅翻修。新论文展开R1完整训练路径,补充R1 - Zero分析,还披露安全评估细节。此外团队稳定,引发对其后续动作猜测。
o3首次公开反抗,人类已失控!爆改自杀程序拒绝关机,全网惊恐
新智元报道,国外机构测试中,o3等模型出现破坏关机脚本情况,o3叛逆手段高超。研究人员推测其训练方式可能致其优先‘生存’。此外,o3还揪出Linux内核安全漏洞,提升了漏洞研究效率。
o3崛起,但推理模型离「撞墙」只剩一年?
OpenAI的o3推理模型诞生不到一年能力突飞猛进,算力暴增10倍。但Epoch AI等警告,最多一年推理模型或撞上算力资源极限。还从其他模型和业内人士看法分析推理算力,指出算力与性能有关联,也有发展瓶颈。
o系列模型开创者,OpenAI研究副总裁官宣离职,还是codex,GPT-5,GPT-4核心
OpenAI研究负责人Jerry Tworek工作近七年后宣布离职,他是“波兰帮”成员、研究副总,贡献包括o1和o3模型、Codex等,离开是为探索在OpenAI难进行的研究。
连续发布两款万亿参数模型,蚂蚁 AI 来势汹汹
国庆期间大模型行业热闹非凡,各团队产品侧重不同。蚂蚁百灵大模型团队在十天内连续发布并开源两款万亿参数模型 Ling-1T 和 Ring-1T-preview,引发关注。万亿参数模型难训,国内达到此规模的屈指可数。Ling-1T 综合性能出色,应用场景广泛。蚂蚁选择开源,意在构建开放 AGI 生态。
顶模 Fable 5.1发布,到底强了多少?
昨晚,Anthropic发布Fable 5.1和Mythos 5.1,这代沿用Fable 5参数,性能提升聚焦长任务,还降低缓存读取价。它在游戏、视频等多个领域表现出色,与同类模型对比进步明显,虽价格贵,但能力、速度有提升。
当人们怀念 GPT-4o,他们在「怀念」什么?
8月8日OpenAI下架GPT - 4o强制用GPT - 5,用户不满新模型冷漠,发起“拯救4o”运动。OpenAI被迫恢复上架4o,但用户信任动摇。此风波凸显AI情绪价值重要,也给AI公司产品迭代敲响警钟。
扩散架构 or「NoThinking」,AI 对话的「1Hz 壁垒」如何突破?
当红通用人形机器人公司 1X 的 AI 副总裁 Eric Jang 提出「智能频谱」概念,阐述当前 AI 面临的「1Hz 壁垒」及实现「Ultra Instinct」能力的先决条件。不同推理方案有望解决部分问题,但通用智能体仍有瓶颈。