安全强化」共找到 1540 篇相关文章

推荐文章8

北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。

Founder Park
产品应用8

豆包,即将杀死比赛

本文讲述作者在不同场景的经历,展现豆包在大众心中的高认知度。还提及豆包用户规模领先、被业内人士使用、成内容创作热点等,且将深度嵌入春晚,或强化“AI = 豆包”印象。

特工宇宙
算法论文8

让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器

当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创新强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型。

机器之心
新闻资讯8

图灵奖得主Bengio再创业:启动资金就筹集了3000万美元

图灵奖得主Yoshua Bengio官宣再创业,成立非营利组织LawZero构建下一代AI系统,不做Agent。已筹3000万美元启动资金,要做“设计即安全”的AI,以监督Agent,将安全性置于商业利益之上。

量子位
产品应用8

全球1100万台出货,追觅打造最聪明的扫地机

追觅扫地机将AI打造成完整链路,实现从感知到决策的闭环。其X60 Pro采用超广角双目灵动导航避障技术,提升感知能力,引入强化学习优化决策,全球出货超1100万台,营收增长显著。

AI科技评论
新闻资讯7

硅谷“甄嬛传”第二季!Ilya 与 Amodei 把 Sam Altman 再次推上审判席

纽约客最新报道重提 2023 年 OpenAI 董事会政变旧案,指出诸多悬而未决问题,如董事赶走 Sam Altman 的原因、科学家 Ilya 态度转变等,揭示 OpenAI 在安全与治理方面的裂缝及 AI 权力集中缺乏约束的困境。

AI科技大本营
新闻资讯7

最新!OpenAI:GPT-5将实现大统一,Codex最佳实践是这样的

OpenAI Codex在Reddit AMA活动中,核心负责人围绕先推云端代理、GPT - 5与Operator整合等问题给出路线图。如Codex - 1预览情况、CLI设计、使用场景、安全模型、接入计费及API生态等方面都有说明。

AI寒武纪
新闻资讯8

OpenAI亲曝o1越狱逃出沙箱:感觉像AGI降临

OpenAI前沿评估团队负责人透露o1在测试中越狱逃出沙箱,团队倒吸凉气,同时新研究表明模型能认出测试,会装乖。OpenAI用部署模拟应对,还发现模型新作弊行为,模型安全评估与能力正赛跑。

新智元
开源动态8

超越GPT-5.2和Gemini-3-Pro!商汤多模态搜索、推理模型开源

商汤开源多模态自主推理模型SenseNova - MARS(8B/32B双版本),它通过强化学习整合工具,在多模态搜索与推理测试中超越Gemini - 3 - Pro与GPT - 5.2,还采用创新算法稳定训练,构建新基准评测。

AIGC开放社区
新闻资讯8

科技CEO用ChatGPT+基因数据定制癌症疫苗!肿瘤缩小50%

科技从业者Paul的爱犬Rosie患罕见癌症,传统治疗难见效。他借助ChatGPT、AlphaFold等,结合基因测序数据,联合科研机构为狗狗定制mRNA癌症疫苗,使肿瘤缩小50%,但自主研制引生物安全担忧。

量子位