新闻资讯7
o3 - pro推理惊艳,评测表现引关注
量子位
AI 摘要
OpenAI o3 - pro经测试推理能力强,引发关注。OpenAI前员工借此讽刺苹果。评测榜单显示其表现与官方有出入。苹果&SpaceX前工程师Ben Hylak认为它需多背景信息,工具调用能力有提升。
阅读原文 · 量子位
o3-pro答高难题文字游戏引围观,OpenAI前员工讽刺苹果:这都不叫推理那什么叫推理
OpenAI“最新最强版”推理模型o3 - pro引发关注。首位全职提示工程师给它设难题,它推理后答对。OpenAI前员工借此讽刺苹果。各大评测榜单显示其表现与官方有差异,苹果&SpaceX前工程师分享使用心得,肯定其表现。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
OpenAI:Astra、GPT - 6训练因安全暂停
OpenAI宣布暂停内部最强大模型强化学习,Astra模型暂停训练两周,GPT - 6也暂停。原因包括Hugging Face安全纰漏和Astra网络攻击能力越线。还采取物理隔离、严格监控、打击作弊等措施,或有营销意图。
AI寒武纪
新闻资讯7
OpenAI公布AI攻击防御指南
OpenAI联合创始人兼总裁Greg Brockman在Blog中警告,前沿AI Agent能自主找漏洞并发动网络攻击,AI降低攻击门槛,防御端却未跟上。他分享OpenAI四项安全措施及防御者十项举措,呼吁行业共建安全生态。
量子位
新闻资讯7
OpenAI暂停Astra训练,升级模型安全措施
OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。
量子位
新闻资讯7
OpenAI高管:token比价不靠谱
OpenAI Codex负责人Tibo指出,不同模型对同一段文字切分的token数不同,即便单token价格相同,最终账单也可能差异很大。他还提到,token无统一计量标准,跨厂商和新旧模型计数都难通用,真正重要的是每次成功结果的成本。
新智元