可核验奖励」共找到 4279 篇相关文章

产品应用8

Sora 2 中国首测?Open AI 这次真成了!

OpenAI提前发布Sora 2模型,克隆音色,支持多语言。还推出似AI版抖音的社交APP,免费生成视频。测试显示,它有世界知识,能多参生成、自动切镜头,在多方面表现出色,但版权限制严,部分一致性待提升。

歸藏的AI工具箱
算法论文8

RLPT:腾讯混元在预训练数据上实现自主强化学习

腾讯混元团队发布RLPT,是在预训练数据上应用强化学习的方法,突破大语言模型扩展瓶颈。它能让模型自主学习推理能力,无需人工标注,在Qwen3 - 4B - Base模型实验中性能显著提升。

AI工程化
产品应用8

你们催更的模型,云栖大会一口气全发了!

云栖大会上新6款模型、发布1个全新品牌,覆盖多场景。如Qwen MAX万亿参数大模型能力登顶国际榜单,Qwen3 - Omni实现全模态不降智等,各模型能力升级显著,现已同步上线。

阿里云开发者
算法论文8

从少样本到千样本!MachineLearningLM给大模型上下文学习装上「机器学习引擎」

新研究 MachineLearningLM 提出轻量移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力大,还指明未来研究方向。

机器之心
新闻资讯8

刚刚,Thinking Machines Lab首次发长文,揭开LLM推理不确定性真相

Thinking Machines Lab发长文《克服LLM推理中的不确定性》,指出大语言模型推理不确定性的真正元凶是缺乏批次不变性,还解释核函数计算中数字加法顺序问题,介绍使核具有批次不变性的方法并给出实验结果。

机器之心
算法论文7

OpenAI新幻觉论文惹争议!GPT-5拉胯是测试基准有问题??

OpenAI新论文《语言模型为何会产生幻觉?》提出,模型有幻觉是因标准训练和评估流程倾向奖励“猜对”。GPT - 5不爱猜测,在榜单表现不佳,网友质疑论文是为GPT - 5挽尊,论文引发网友多方向讨论。

量子位
算法论文8

AI里最大的Bug,却也是人类文明最伟大的起点。

OpenAI论文指出AI产生幻觉是因其训练方式奖励瞎蒙行为。以考试为例,AI在信息不足时猜测是最优策略。还从统计学解释根源,指出解决幻觉需改变评估指标,也引发对人类想象力起源的思考。

数字生命卡兹克
推荐文章8

李国杰院士:AI4S里程碑式重大成果综述

本文由李国杰院士撰写,对AI for Science近年里程碑式突破做全面综述,涵盖数学、物理、化学等多领域成果,如李雅普诺夫函数构造、AI辅助核聚变等,还探讨了AI4S潜力与挑战。

力学与人工智能
新闻资讯7

狂砸百亿美元后,仅5%企业成功落地AI,他们做对了什么?

企业在生成式AI领域投入数百亿美元,但95%的机构未获衡量商业回报,此为「GenAI鸿沟」。原因包括工具缺乏学习能力、预算分配失衡等。少数成功企业聚焦高价值用例,选易部署工具,与供应商深度合作。

Founder Park
开源动态8

视觉Token注入CLIP语义,走向多模态理解与生成新范式

腾讯ARC Lab等机构提出全新视觉分词器TokLIP,将低级视觉Token与高级CLIP语义结合,支持端到端自回归训练,接入LLM框架,降低计算与数据门槛,在多模态任务中表现优异,代码已开源。

量子位