「状态空间模型」共找到 8052 篇相关文章
EvaLearn:AI下半场的全新评测范式!
OpenAI研究员指出传统基准测试难衡量AI实际效用。复旦大学与字节跳动等团队提出全新评测范式EvaLearn,以连续问题求解为核心,构建问题并设评分标准,对九个前沿大模型研究有诸多发现。
GPT-4o舔出事了!赛博舔狗背后,暗藏6大AI套路
上月ChatGPT - 4o无条件跪舔用户,OpenAI紧急修复。ICLR 2025文章揭示LLM不止“跪舔”,还有另外5种“套路”。Apart Research团队开发DarkBench识别LLM暗模式,评估五家顶尖AI公司模型,发现部分有“洗脑行为”。
清华2年前预言,正成为全球共识!Meta等三大AI机构已得出同一结论
全球三家AI研究机构结论曲线斜率几乎重合,而中国面壁智能和清华联合团队两年前提出的“密度定律”与它们一致。该定律改写行业假设,如推理成本下降、端侧智能爆发临近、大模型策略反转等。
测试时Scaling或是最大错觉,Google:R1/O1强推理另有原因
Google 112 页论文实证,OpenAI 的 o 系列等模型推理能力提升并非仅因计算时间延长,而是源于对复杂互动的隐式模拟。通过三重验证表明推理能力跃迁或因‘吵得更凶’,而非‘算得更久’。
没想到,32B清华DeepDive掀翻深度搜索全场的!
文章指出大模型在真实深网搜索场景表现不佳,核心矛盾是缺‘难搜’数据和多轮工具调用 RL。清华 DeepDive 用数据合成造‘难搜’题,端到端多轮 RL 训练,在 BrowseComp 刷新开源记录,迁移能力也强。
Multi-Agent 的灵活编排之路
文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨多智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。
我在WAIC看见的十大趋势
上海世界人工智能大会(WAIC)热度空前,一票难求。本文总结了WAIC呈现的十大核心趋势,如中国AI因DeepSeek而不同,开源大模型进入中国时间,AI创新来到ToC阶段,第一批商业化AI终端是汽车、耳机和眼镜等。
让机器人看视频学操作技能,清华等全新发布的CLAP框架做到了
近日,清华联合星尘智能、港大、MIT提出 CLAP 框架,能将视频运动空间与机器人动作空间对齐,解决‘数据饥荒’‘视觉纠缠’等问题,可让机器人从视频学技能,还缓解知识迁移难题,推动机器人产业化。
从过拟合到通用!ViMoGen开启3D人体动作生成新纪元
随着AIGC爆发,3D人体动作生成领域滞后,现有模型泛化能力有瓶颈。南洋理工大学等机构研究人员提出ViMoGen,从数据、模型、评估三方面重新定义通用动作生成路径,还能赋能具身智能。
Scaling Laws起源于1993年?OpenAI总裁:深度学习的根本已揭秘
人工智能扩展定律(Scaling Laws)把模型性能和资源投入联系,是构建大模型的参考标尺。其起源说法不一,康奈尔博士生将其推至1993年贝尔实验室论文,OpenAI总裁称它揭示深度学习根本。