实验缺陷」共找到 1466 篇相关文章

新闻资讯8

Andrej Karpathy 开炮:智能体都在装样子,强化学习很糟糕,AGI 十年也出不来

本周五,Andrej Karpathy 长达两小时多的采访视频引发关注。他直言行业步子迈得太大,嘲讽 AI 现状夸大、脱离实际。他认为智能体成熟需十年,强化学习糟糕,还探讨了 AGI、人类学习、教育未来等多方面问题。

机器之心
算法论文8

斯坦福、英伟达和伯克利提出具身Test-Time Scaling Law

斯坦福、英伟达和伯克利团队提出具身Test - Time Scaling Law。研究发现推理时增加计算量可提升VLA模型性能,揭示动作误差与采样数量幂律关系,还探讨关键问题,给出方法,实验证明结合RoboMonkey能显著提升性能。

机器之心
算法论文8

首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒

新加坡国立大学等联合发布EgoTwin,首次实现第一视角视频与人体动作联合生成,攻克视角 - 动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决核心难题,实验性能超基线,为多领域应用提供落地基座。

量子位
算法论文8

不愧是中国机器人,乒乓打得太6了

清华姚班本科生苏智团队在论文中提出结合模型规划与强化学习的分层框架,让宇树G1机器人实现亚秒级反应下的稳定连续对打,在真实实验中击球和回球率高,还能连打106拍。

量子位
开源动态8

字节Seed开源长线记忆多模态Agent,像人一样能听会看

字节Seed发布全新多模态智能体框架M3 - Agent,能听会看、有长期记忆且免费开源。团队还开发新长视频问答基准M3 - Bench并开源。实验显示,M3 - Agent在多基准测试中显著优于基线模型。

量子位
新闻资讯8

刚刚,Sam Altman宣布:GPT-5即将发布

Sam Altman在X上宣布OpenAI通用推理系统在2025年IMO达金牌水平,同时透露GPT - 5即将发布。OpenAI研究员Alexander Wei介绍突破细节,模型解决多道题获35分。GPT - 5是实验模型,有金牌能力的版本还需等待。

AGI Hunt
算法论文8

直播预约 | SwS: 强化学习训练能否不依赖外部知识优化模型的弱点?

该论文提出强化学习场景下的启发式数据合成流程(SwS),利用模型自我感知弱点驱动自动化问题生成,弥补推理缺陷。对其扩展后适应性更广,在多基准测试集和模型上验证有效,性能提升显著。

深度学习自然语言处理
开源动态8

o3绞尽脑汁仅答对40%的题目,开源模型基本乱猜?MMSI-Bench:多图空间智能试金石

文章介绍了MMSI - Bench,这是用于评估MLLM多图像空间推理能力的VQA基准。它人工构建样本、全面分类任务、采用多样真实数据。实验显示MLLM在多图像空间推理有短板,还开发自动化错误分析流程助力改进。

量子位
产品应用8

微信自研高性能推理计算引擎 XNet-DNN:跨平台 GPU 部署大语言模型及优化实践

本文深入解析微信自研的高性能推理计算引擎 XNet-DNN,介绍其核心技术架构和性能优化策略。该引擎基于 RCI 框架构建跨平台 GPU LLM 推理能力,在多方面超越现有解决方案,还给出了详实对比实验数据。

腾讯技术工程
推荐文章7

大概念模型:AI 推理的新范式

大概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。

InfoQ