通用验证器」共找到 1699 篇相关文章

推荐文章8

构建分层的 Agentic RAG 系统:具备自主纠错的多模态推理

企业 AI 团队面临 RAG 系统在处理结构化与非结构化数据时的难题。本文探讨用分层多智能体编排解决“模态鸿沟”,介绍 Protocol - H 架构,阐述组件、机制、实现与集成,经基准测试验证其优势,还提及未来研究方向。

InfoQ
算法论文8

PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的可学习加权混合自编码

本文将线性POD与非线性Autoencoder通过可学习参数融合,提出可学习加权混合自编码架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或可降低大规模计算成本。

力学与人工智能
算法论文8

ICLR 2026 | ProSafePrune:一剪见效,告别大模型过度防御

合肥工业大学与科大讯飞联合团队提出全新低秩参数修剪框架 ProSafePrune,被 ICLR 2026 录用。它能精准定位模型认知偏差并修剪,降低过度拒绝率,不损安全防御能力,还提升通用任务性能,为 LLM 安全部署提供新思路。

机器之心
新闻资讯7

Claude版Manus只用10天搓出,代码全AI写的!网友:小扎140亿并购像冤大头

Claude Cowork是面向工作场景的通用智能体,基于Anthropic自研模型打造。开发约10天,代码全由Claude Code写,人类仅负责规划等。它让非编程用户能用AI能力,这让扎克伯格20亿买Manus的操作显得冤。

量子位
算法论文8

大模型如何泛化出多智能体推理能力?清华提出策略游戏自博弈方案MARSHAL

近日,清华大学等机构研究团队提出 MARSHAL 框架,利用强化学习让大模型在策略游戏自博弈。实验表明,多轮、多智能体训练提升了模型博弈决策水平,将推理能力泛化到通用多智能体系统,在一般推理任务表现显著提升。

机器之心
新闻资讯7

「一脑多形」圆桌:世界模型、空间智能在具身智能出现了哪些具体进展?|GAIR 2025

在第八届GAIR全球人工智能与机人大会“数据&一脑多形”分论坛的圆桌论坛上,高飞、金鑫、王靖博三位学者围绕具身智能、空间智能、世界模型等话题展开讨论,探讨研究进展、挑战与机遇,还谈及创业和数据获取等问题。

AI科技评论
新闻资讯8

黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货

英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。

新智元
算法论文8

突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!

近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成变分问题形成自我提升循环,实验效果惊人。

深度学习自然语言处理
算法论文8

AI已迷失方向?强化学习教父Sutton最新发布OaK架构,挑战当前AI范式,提出超级智能新构想

强化学习教父理查德·萨顿认为人工智能发展已迷失方向,提出OaK架构回应探寻真正智能的需求。该架构是基于模型的强化学习架构,具备组件持续学习等特点,为通用人工智能指明路径,但面临持续学习和特征生成挑战。

AI科技大本营
推荐文章3

16 个月、45 万资金投入,一款 AI 社交产品的创业失败复盘

作者复盘AI社交产品“抱抱窝”创业失败经历,涉及方向选择、团队搭建、时间资金把控、团队沟通等问题,还给出经验建议,如选方向要有标准,团队开发股份占比应合理,明确时间表等。

Founder Park