「条件表征学习」共找到 1539 篇相关文章
RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘
近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。
OpenAI要跳过5.3,直接迈向GPT-5.4了?
近日,一名OpenAI工程师在公开的Codex GitHub仓库中提交拉取请求,让GPT - 5.4型号出现在代码版本判断条件中,同时有用户发现它曾短暂出现在Codex应用的模型选择器里。线索被迅速修改或删除,引发诸多猜测。
30人团队震撼英伟达!Jim Fan自曝三个教训,重押世界模型
英伟达Jim Fan带队创立GEAR实验室,30人团队产出惊人,涵盖机器人学习完整技术栈。团队有GR00T基础模型等成果,Jim Fan还分享三个教训,重注视频世界模型,提出仿真世界三阶段,指出物理AI未来是新基础设施。
PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃
快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化学习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数学推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。
LeCun在Meta的最后一篇论文
LeCun于11月11日提交最新论文《LeJEPA:无需启发式的可证明且可扩展的自监督学习》,当天其离职Meta消息曝光。论文提出LeJEPA自监督学习方法,解决表示崩溃问题,还回顾了JEPA架构发展,虽毁誉参半,但LeCun将继续推进世界模型工作。
2025 的企业 AI 市场, Data &AI 占据主流视野
数据是 AI 模型学习和训练的基础,Data & AI 基础设施可打通数据与 AI 全链路。企业应用 AI 不应只关注算法和算力,还需重视私域数据。同时介绍了不同类型企业在 Data & AI 领域的特点及合作成本等内容。
刚刚,马斯克开源Grok 2.5:中国公司才是xAI最大对手
马斯克主导xAI正式开源Grok 2.5,Grok 3将半年后开源。Grok可在HuggingFace下载,运行有条件。虽Grok 2曾有不错表现,但网友对其参数权重、开源协议等有诟病。此外,还更新APP视频生成功能,马斯克称中国公司是xAI最大对手。
全球95%企业AI惨败?MIT报告引硅谷恐慌!90%员工偷用ChatGPT续命
MIT报告《The GenAI Divide: State of AI in Business 2025》指出,95%企业AI试点项目失败,但90%员工用ChatGPT等个人AI工具办公。消费级工具因灵活易用胜企业级,企业应向员工学习,与供应商合作。摩根士丹利报告称AI可为企业省成本。
AI上清北,普通人该怎么办?|甲子光年
2025年AI模拟高考成绩达清北线,引发对人类努力意义的思考。三位嘉宾围绕AI能力进步、与人类能力差异、对教育和创作的影响等展开对谈,探讨人类在AI时代的定位、专业选择、教育变革等问题。
ICML 2025放榜!接收率26.9%,高分被拒,低分录用惹争议
第42届国际机器学习大会(ICML)2025放榜,接收率26.9%。文章汇总了被接收的优秀论文如MARS、ShadowKV等,以及有争议的论文,一些高分被拒、低分录用,评审存在矛盾与粗心问题,欢迎读者在评论区讨论。