动作流匹配」共找到 535 篇相关文章

新闻资讯8

我拥有了超能力!Meta最牛文科生让3个AI互掐,竟造出1人技术部

Meta产品经理Zevi Arnovitz零技术基础,借助Cursor和Claude治愈代码恐惧。他分享经历,用管理团队方式管理AI,建立开发,还让AI互审代码。AI正让普通人构建未来,职场需全能构建者。

新智元
算法论文8

PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃

快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化学习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数学推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。

机器之心
新闻资讯8

Ilya 最新访谈,预训练时代终结后,AI行业来到了哪里?

Ilya接受90多分钟深度访谈,指出当前大模型泛化能力远不如人,Scaling时代终结,研究时代回归。还谈到AI经济影响与跑分不匹配、泛化能力鸿沟、情感价值等问题,预测超级智能5 - 20年到来。

探索AGI
新闻资讯7

GPT-5.1 突然发布,用户实测:更像 4o,情商大幅提升

OpenAI 向部分付费用户推送 GPT - 5.1,有即时思考和深度思考两种模式,系统自动匹配。它有八种人格预设,改进不仅在语气,还提升记忆编织等能力,像是补救 GPT - 5 失败,还扩展安全评估。

AI工程化
算法论文8

DeepAgent:能够自主找工具的深度思考智能体,工具&任务随心配

现有智能体框架自主性差、工具使用受限。中国人民大学等机构研究者提出DeepAgent,能自主思考、发现工具并执行动作。它在多基准测试中表现出色,为构建更强真实世界智能体迈进重要一步。

PaperAgent
算法论文8

智能体系统如何「边做边学」?斯坦福团队探索在线优化的新范式

斯坦福等校团队提出 AgentFlow 框架及 Flow - GRPO 算法,让智能体系统能「边做边学」。它由多个智能体模块协作,在多领域基准测试中表现出色,小模型也能超越大模型,为智能体训练提供新思路。

机器之心
算法论文8

AI打通第一/第三人称视觉,跨视角视觉理解新SOTA|ICCV 2025 Highlight

INSAIT、复旦大学等联合提出ObjectRelator框架,让AI精准匹配不同视角下同一物体,实现跨视角统一表征与理解。它在Ego转Exo和Exo转Ego任务上超基线模型,已被ICCV 2025接收,代码开源。

量子位
新闻资讯7

全球AI视频大战升级!「中国版Sora」Vidu Q2参考生月底发布,能力对标Sora 2

OpenAI的Sora 2引发全球AI视频狂欢,而国产AI视频Vidu将在本月底升级Vidu Q2参考生功能。Vidu起步更早、覆盖广,在一致性、运镜理解、动作连贯等维度优势明显,月底升级值得期待。

新智元
产品应用7

人形机器人终于学会洗碗了

Figure机器人学会洗碗,用的是叠毛巾和分包裹同款Helix架构,无新算法和特殊工程,仅增加新数据。该架构是端到端“视觉 - 语言 - 动作”模型,同一系统增数据就能学新技能。

量子位
算法论文8

模拟大脑功能分化!北大与港中文发布Fast-in-Slow VLA,让“快行动”和“慢推理”统一协作

北大与港中文研究团队发布 Fast-in-Slow(FiS-VLA)全新双系统视觉 - 语言 - 动作模型,将快速执行模块嵌入预训练视觉 - 语言模型,实现快慢系统一体化。该模型在多平台表现优异,控制频率大幅领先。

机器之心