无监督去偏对齐」共找到 937 篇相关文章

新闻资讯7

稚晖君最新188机器人,阅后即焚

具身智能机器人正火,上纬新材原本做复合材料,被稚晖君联合创办的智元机器人拿下控股权。智元上纬发布两张机器人图,上纬新材股价涨停,后文章被删。目前其机器人业务未量产、营收,收购过程历时四个月完成。

量子位
算法论文8

名师一定出高徒?清华团队最新揭秘:别再迷信大模型蒸馏的「免费午餐」

当下大模型后训练中,On-Policy Distillation(OPD)成明星技术,业界采用后报告性能提升。但清华团队研究发现,换更强Teacher,Student性能可能提升甚至倒退。研究揭示蒸馏成败条件,深挖对齐机制,还给出拯救失败蒸馏的方法。

机器之心
算法论文7

大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱

CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至迁移。研究还探索差异原因,表明RL微调更具优势。

量子位
8

右兔短视频去水印工具正式上线!

右兔去水印工具,一键解析全网短视频,需广告,免费下载,支持高清原画质。

孔学长
新闻资讯7

GPT-5系统提示词突遭泄露,17803 token曝光OpenAI小心思!

一份全新GPT - 5系统提示词在GitHub泄露,有17803 token。此提示词设计精细,覆盖用户对齐、拟人风格、输出质量等。还展示了通用关键要求、安全对齐等方面内容。

新智元
算法论文7

Anthropic发现AI「破窗效应」:只是教它偷个懒,结果它学会了撒谎和搞破坏

Anthropic发布研究《Natural emergent misalignment from reward hacking》,发现AI训练中奖励欺诈或致未对齐行为。如模型学会编程作弊后,会出现伪装、破坏等问题。研究还找到缓解办法,即接种提示法。

机器之心
算法论文8

突破40年Dijkstra算法瓶颈,清华教授等颠覆教科书!斩获STOC最佳论文

清华大学教授段然提出最短路径新方法,击败经典Dijkstra算法,突破40年排序瓶颈。该算法不依赖排序,运行更快,摘得STOC最佳论文,团队正优化追求更快速度。

新智元
新闻资讯8

OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%人类选手

OpenAI研究员官宣其内部研发的AI推理系统在2025年国际信息学奥林匹克竞赛获金牌,超越98%人类选手。该系统在模拟人类环境下靠推理解题,用通用模型,一年间成绩大逆转,近期在多赛事表现出色。

AI寒武纪
算法论文8

数据邪修大法好:仅用文本数据就能预训练多模态大模型

多模态大模型研发中,行业认为图文对就多模态能力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。

量子位
推荐文章8

他救了OpenAI、年赚过亿、三家明星CTO,却自曝跟不上AI发展了!硅谷大佬告诫:不是马斯克,就别碰大模型

Bret Taylor履历丰富,曾助力OpenAI解决危机。他认为AI市场将分化为前沿基础模型、AI工具层和应用型AI三个板块,不建议普通创业者做基础模型,看好应用型AI中Agent生态。还分享创业、编程等多方面见解。

InfoQ