验证者法则」共找到 1239 篇相关文章

算法论文8

V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间

近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 在论文中提出视频表征自编码器 V-RAE。它以冻结的视觉基础模型为编码器压缩视频特征,还引入轻量级模块聚合信息。经实验验证,其在视频生成和预测上性能出色。

机器之心
算法论文8

RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘

近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。

新智元
推荐文章7

AI 编码 3.0:人机协作,正在走向多 Agent 协作系统化

文章指出AI编码正从2.0走向3.0,2.0解决生成问题,3.0则是执行系统。当Agent进入软件交付流程,协作需从经验驱动转向模型驱动,Kanban和Harness等工具也有了新角色,系统更强调验证和控制。

phodal
推荐文章7

大模型最难的AI Infra,用Vibe Coding搞定

Andrej Karpathy 力荐的 Vibe Coding 在 AI Infra 开发中常「水土不服」,存在上下文丢失、决策偏离、质量不稳定等问题。文章提出文本驱动的 Vibe Coding 方法,并以 Agentic RL 中的资源调度系统为例验证其有效性,还介绍了相关团队和工具。

机器之心
新闻资讯7

推理之父走了!OpenAI七年元老离职:有些研究这里没法做

新年伊始,OpenAI研发副总裁Jerry Tworek离职,他是编程和两大核心技术路线奠基,攻克LLM编程和复杂推理商业化难题。他称想探索在OpenAI难开展的研究。此前已有多位核心人才出走,OpenAI或因商业化与安全问题留不住人。

新智元
算法论文8

亿级短视频数据突破具身智能Scaling Law!Being-H0提出VLA训练新范式

真机数据匮乏使具身智能VLA模型发展受限,现有真机数据与所需上亿级训练样本相差甚远。BeingBeyond团队提出创新性方案,利用人类视频手部数据构建数据集,训练出VLA模型Being - H0,经实验验证效果良好。

量子位
产品应用7

一家智能眼镜公司,为什么非要自研AI大模型系统?|甲子光年

智能眼镜要么不够智能,要么不像眼镜,李未可科技CEO茹忆认为AI要成第一响应。该公司推三款AI眼镜,搭载自研系统。其自研AI大模型系统,是为交付难复制AI体验闭环,解决通用API不足等问题。

甲子光年
开源动态8

社区供稿 | Index-AniSora 技术升级开源: 动漫视频生成强化学习

B站升级动画视频生成模型Index - AniSora技术并开源,支持多种二次元风格视频镜头一键生成。基于相关研究提出首个专为二次元视频生成的强化学习技术框架,构建奖励数据集、训练AnimeReward、提出GAPO优化策略,实验验证其有效性。

Hugging Face
新闻资讯8

AI水论文封一年,署名连坐!arXiv最严新规来了,陶哲轩附议

arXiv计算机科学版块主席公布新规,上传AI水论文被查实封禁一年,后续投稿须先同行评审。若有未核查LLM生成内容证据,署名作连坐。陶哲轩附议,指出论文生成易、消化难,新政方向正确,但治不了学术‘争先为首’病根。

量子位
新闻资讯8

从工具到生命形式:OpenClaw 引发的 Agent 再思考

InfoQ《极客有约》X QCon 直播邀业内专家探讨 OpenClaw 落地难点。专家认为,这波 Agent 热潮验证了复杂工作可被系统承接,也指出 OpenClaw 虽非生产级产品,但推动了全民 Agent 浪潮,同时探讨了模型与编排层结合、记忆系统等问题。

AI前线