产品应用7
OpenAI开放GPT - 4.1 DPO微调
AGI Hunt
AI 摘要
OpenAI:GPT - 4.1全系列支持DPO微调,能让AI学会用户偏好。开发者反应不一,有人兴奋,有人提需求与担忧。使用DPO要注意数据、参数、训练策略等要点。
阅读原文 · AGI Hunt
刚刚,OpenAI开放GPT-4.1偏好优化DPO,ChatGPT能真正学会你的「品味」了!
OpenAI宣布GPT - 4.1全系列模型支持DPO微调,可让AI通过对比回答学会用户偏好。介绍了DPO原理、适用模型、数据格式、创建任务方法等,还提及开发者反应与技术要点。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
OpenAI:Astra、GPT - 6训练因安全暂停
OpenAI宣布暂停内部最强大模型强化学习,Astra模型暂停训练两周,GPT - 6也暂停。原因包括Hugging Face安全纰漏和Astra网络攻击能力越线。还采取物理隔离、严格监控、打击作弊等措施,或有营销意图。
AI寒武纪
新闻资讯7
OpenAI公布AI攻击防御指南
OpenAI联合创始人兼总裁Greg Brockman在Blog中警告,前沿AI Agent能自主找漏洞并发动网络攻击,AI降低攻击门槛,防御端却未跟上。他分享OpenAI四项安全措施及防御者十项举措,呼吁行业共建安全生态。
量子位
新闻资讯7
OpenAI暂停Astra训练,升级模型安全措施
OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。
量子位
新闻资讯7
OpenAI高管:token比价不靠谱
OpenAI Codex负责人Tibo指出,不同模型对同一段文字切分的token数不同,即便单token价格相同,最终账单也可能差异很大。他还提到,token无统一计量标准,跨厂商和新旧模型计数都难通用,真正重要的是每次成功结果的成本。
新智元