「GPT-5-Codex」共找到 2474 篇相关文章
突发!Claude 4.5 发布,这次更新不止是模型!
Anthropic发布Claude 4.5,在编程等任务中表现优于GPT - 5。Claude Code升级,API添新功能,模型能力提升,对齐性改善。还推出Claude Agent SDK及“Imagine with Claude”功能。
马斯克:Grok 5 将实现真正的 AGI
Vending Bench测试中,xAI的Grok 4以近两倍销售量和31%高收益击败GPT - 5,展现惊人稳定性。马斯克却称Grok 5有机会成真正AGI,引发网友各种反应,Grok 4虽领先但也有争议。
突发!Claude Opus 5深夜震撼发布,多项跑分锤爆Fable 5,价格腰斩
Claude Opus 5正式发布,总体智能逼近Claude Fable 5,价格仅为一半,多项跑分超Fable 5。它专为高频使用设计,各领域进步显著,有强自我验证和迭代能力,还发布API更新与提示词编写指南。
陶哲轩联手GPT-5,1小时攻克数学难题!全程无需编码,OpenAI副总惊呼
陶哲轩联手ChatGPT攻克MathOverflow复杂数学题,节省数小时编码时间。他先让ChatGPT生成代码,后改用分步对话找参数,还验证结果。AI助其发现错误、优化流程,凸显在数学研究的潜力。
当人们怀念 GPT-4o,他们在「怀念」什么?
8月8日OpenAI下架GPT - 4o强制用GPT - 5,用户不满新模型冷漠,发起“拯救4o”运动。OpenAI被迫恢复上架4o,但用户信任动摇。此风波凸显AI情绪价值重要,也给AI公司产品迭代敲响警钟。
Claude Sonnet 4.5 发布,30 小时自主编码刷新行业纪录
Anthropic发布Claude Sonnet 4.5,号称最强编程模型,自主编码达30小时。它性能超GPT-5等,Claude Code升级,文件处理、API能力增强,价格不变,多平台集成,还通过白盒审计提升安全性。
有人只用API就猜出了GPT、Claude、Gemini的参数量?社区吵翻了
研究人员李博杰在arXiv发布论文,提出“不可压缩知识探针”评测框架,仅通过黑盒API调用逆向估算LLM参数规模,给出GPT-5.5等模型参数量估算,引发社区广泛讨论与争议。
狂奔AGI,Claude年终封王!自主编码近5小时震惊全网
METR报告称Claude Opus 4.5能持续自主编码5小时,超OpenAI最强编程模型。AI编码智能体任务时长指数级增长,不过迈向AGI仍面临长期记忆难题,未来一年该领域或有突破。
OpenAI「GPT门」事件引爆!Plus、Pro账户统统降配,偷换模型全网实锤
OpenAI被曝在用户不知情下,将GPT-4、GPT-5等模型路由至低算力敏感模型,引发用户对选择权和付费权益质疑。该现象已在社交媒体广泛验证,OpenAI回应称是在测试新安全路由系统。
Claude Opus 5 发布,比 Fable 5 强,仅一半价格
Claude Opus 5发布,官方称其以一半价格提供接近Fable 5的智能。跑分显示它多数项目超Fable 5,ARC - AGI - 3成绩突出,还更省token,是Anthropic迄今对齐度最高的模型。