新闻资讯7
OpenAI:暂停前沿模型强化学习训练
机器之心
AI 摘要
OpenAI:暂停前沿模型强化学习训练两周,部分低风险训练已恢复。因Hugging Face事故和Astra模型风险,加强监控、对齐和安全措施,先把模型停下应对能力与安全问题。
阅读原文 · 机器之心
突发!OpenAI停止强化学习训练两周
OpenAI发文称暂停最新模型强化学习训练两周,加固研究环境、进行红队测试等。部分低风险训练已恢复,最大规模前沿模型训练仍暂停。此举源于Hugging Face安全事故及Astra模型潜在风险。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
OpenAI Astra:网络攻防能力逆天且听话!
OpenAI即将发布的模型Astra,在内部评测中获ExploitBench满分,还发现两个零日漏洞。它能力远超上一代GPT - 5.6 Sol且更听话。不过为安全考虑,OpenAI部署监控,还放慢其研究速度。
新智元
新闻资讯7
OpenAI预热Astra:能力强但安全成难题
OpenAI为下一代模型Astra(传说中的GPT - 6)拉满预热,公开其能力。它在网络安全测试表现出色,但强大能力带来安全隐患。OpenAI设两道安全闸门,且两位华人研究员参与研发。此外,其新技术或影响可监控性。
量子位
新闻资讯7
OpenAI新模型Astra技术降本却添安全忧
9月2日消息,OpenAI将推出的旗舰模型Astra采用“循环深度”新技术,用较小模型实现庞大模型性能,降低成本。但该技术会让AI推理过程不可读,加重安全担忧,此前奥特曼已因Astra“能力过强”踩刹车。
AI前线
新闻资讯7
孙鹏加盟星尘智能,强化机器人后训练
9月2日消息,前字节跳动Seed团队强化学习专家孙鹏博士加入星尘智能,负责机器人强化学习方向。星尘智能有技术、资本和商业优势,孙鹏经验丰富,此次加入将助力其强化学习后训练发展。
AI前线