新闻资讯7
OpenAI IMO团队:AI解难题仍路漫漫
机器之心
AI 摘要
OpenAI IMO团队爆料,项目仅三人用两三月完成。模型证明风格独特,第六题拒绝作答体现知能力边界。解决千禧年大奖难题尚远,后续需解决评估瓶颈、让模型学会提问题等。
阅读原文 · 机器之心
OpenAI IMO金牌团队爆料:AI拒绝作答第六题
OpenAI IMO团队接受采访,透露让模型获IMO金牌的项目仅用两三个月、核心开发者仅三人。还谈及模型证明风格、第六题失分原因、解决千禧年大奖难题距离等,强调通用技术及面临的新挑战。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
OpenAI Astra:网络攻防能力逆天且听话!
OpenAI即将发布的模型Astra,在内部评测中获ExploitBench满分,还发现两个零日漏洞。它能力远超上一代GPT - 5.6 Sol且更听话。不过为安全考虑,OpenAI部署监控,还放慢其研究速度。
新智元
新闻资讯7
OpenAI预热Astra:能力强但安全成难题
OpenAI为下一代模型Astra(传说中的GPT - 6)拉满预热,公开其能力。它在网络安全测试表现出色,但强大能力带来安全隐患。OpenAI设两道安全闸门,且两位华人研究员参与研发。此外,其新技术或影响可监控性。
量子位
新闻资讯7
OpenAI新模型Astra技术降本却添安全忧
9月2日消息,OpenAI将推出的旗舰模型Astra采用“循环深度”新技术,用较小模型实现庞大模型性能,降低成本。但该技术会让AI推理过程不可读,加重安全担忧,此前奥特曼已因Astra“能力过强”踩刹车。
AI前线
产品应用8
Anthropic发布Claude 5.1,性能优成本低
Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1面向普通用户等,Mythos 5.1面向高风险领域伙伴。Fable 5.1性能优、价格低,在多测试中表现提升,还能用于科研,且安全防护机制升级。
机器之心