潜空间推理」共找到 2449 篇相关文章

算法论文8

突破后训练瓶颈?Meta超级智能实验室又一力作:CaT解决RL监督难题

AI后训练依赖监督微调或程序化检查器,但很多有价值任务缺这两种资源。Meta超级智能实验室等机构研究者提出CaT方法,把推理时额外计算当教师信号,为大模型提供监督,实验显示效果显著。

机器之心
算法论文8

让机器人学会系统2慢思考,叠衣服倒咖啡等不在话下 | 上海交大&智元机器人

上海交通大学与智元机器人等团队推出Hume——融合系统2慢思考的双系统VLA模型。它结合深度推理与实时控制,在多种机器人平台实验中表现出色,平均成功率达91%,显著超越现有模型。

量子位
产品应用8

首个实时端侧部署世界模型,20万小时人类视频,BeingBeyond实现「两级跃迁」

4月14日,BeingBeyond发布具身世界模型Being - H0.7,将人类视频规模扩至20万小时,采用隐式推理范式,6项权威评测综合第一。还率先实现端侧实时部署,打通数据闭环,推动模型通用与专家能力跃迁。

AI科技评论
推荐文章8

这一年做 Agent 的公司,Coding 赚了钱,客服融了钱,你呢?

全球数据研究机构 CB Insights《AI Agent Bible》报告梳理 Agent 行业概况。指出未来趋势,如语音成主流交互等;分析发展受限问题、有力机会;还介绍不同类型 Agent 商业情况及应对推理成本策略等。

Founder Park
算法论文8

强化学习的两个「大坑」,终于被两篇ICLR论文给解决了

现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实时强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。

机器之心
开源动态8

10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源

阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。

AIGC开放社区
算法论文8

VAE时代终结?谢赛宁团队「RAE」登场,表征自编码器或成DiT训练新基石

纽约大学谢赛宁团队推出RAE替代VAE,解决了DiT依赖旧版SD - VAE的问题,如架构复杂、空间受限等。RAE结合预训练编码器和解码器,还提出DiT^DH变体,实验效果好,网友看好其前景。

机器之心
推荐文章8

吴恩达来信:智能体并行运行以提升效率

吴恩达称并行智能体成扩展AI规模新方向。AI性能会随数据量、训练及推理计算量提升,但耗时久。随着LLM每个token价格下降,更多智能体工作流被并行化,且相关研究增多。

DeeplearningAI
推荐文章7

深入剖析AI公司正在面临的:「囚徒困境」

文章指出AI模型训练成本虽下降,但运营成本尤其是推理费用飙升,使AI公司陷入两难。用户只青睐最强模型,且模型资源消耗远超预期,订阅模式难以为继,还给出了避免亏损的三条出路。

AINLPer
推荐文章7

Token成本下降,订阅费却飞涨,AI公司怎么了?

文章指出,虽模型训练成本下降,但 AI 公司运营成本尤其是推理费用猛增。以固定费率订阅和高 token 消耗的商业模式的公司面临困境,如 Windsurf、Claude Code 等,还给出避免亏损的三条出路。

机器之心