「泛化难题」共找到 1575 篇相关文章
LeCun出手,造出视频世界模型,挑战英伟达COSMOS
训练有效世界模型面临数据、任务难度、算力消耗和评估等难题。Meta研究者提出通用视频世界模型DINO - world,可预测未来帧,在多方面有优势,实验显示其性能显著,能降低对标注数据需求。
港科大&北京人形提出LOVON:足式机器人开放世界全域目标追踪新范式!
港科大广州联合北京人形创新中心推出LOVON框架,融合大语言模型、开放词汇视觉检测和语言 - 运动映射模型,解决足式机器人开放世界全域目标追踪难题,有抗干扰视觉处理等优势,性能超传统方法。
谷歌DeepMind最新论文,刚刚登上了Nature!揭秘IMO最强数学模型
谷歌DeepMind的AlphaProof在IMO获接近金牌的银牌成绩。它结合大模型直觉、强化学习和Lean形式化证明解题,虽在速度、泛化和读题上有局限,但开启了人类数学家与AI协作新阶段。
X上63万人围观的Traning-Free GRPO:把GRPO搬进上下文空间学习
年初 DeepSeek - R1带火大模型强化学习,GRPO成常见RL算法,但训练成本高。腾讯优图论文提出Training - Free GRPO,将GRPO训练范式迁移到上下文学习,成本低、泛化好,已开源。
火山引擎,「出击」Agent
2025 年年中大模型竞争进入下半场,Agent 成焦点。文章分析其 2B 与 2C 落地困境,介绍火山引擎新开发范式,如 TRAE、豆包大模型 1.6、PromptPilot 等,助企业解决 B 端落地难题。
AST| 西工大单湘淋、张伟伟等:基于湍流各向异性分析与符号回归的改进型二阶非线性涡粘模型
针对非线性涡粘模型各向异性建模难题,西工大单湘淋、张伟伟等通过雷诺应力各向异性分析方法开展特征提取,构建新型二阶非线性涡粘模型,在方形管道与矩形扩压器湍流测试中,精度优于现有模型。
强化学习+大模型记忆:Mem-α,让智能体第一次学会“如何记忆”
在大语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入大模型记忆管理体系,解决记忆难题,在性能、泛化等多方面表现出色。
MIDAS:快手可灵发布实时交互式数字人生成框架
近年来交互式数字人视频生成受关注,但实时处理多模态输入有挑战。快手可灵团队提出MIDAS框架,基于LLM驱动的自回归模型,结合轻量级扩散头,实现低延迟、交互式多模态控制,还构建大规模数据集等。
未来,你的 Agent 怎么付钱?
借 a16z 文章,探讨 Agent payment 领域进展。实现 Agent 自主支付是未来关键方向,现已有迹象且部分企业推出解决方案,但 Agent 处理支付尚未真正自主,还面临角色范围、欺诈、责任归属等难题。
刚刚,好莱坞特效师展示AI生成的中文科幻大片,成本只有330元
AI领域发展迅速,视频生成能力提升。百度全球首发中文音视频一体化模型百度蒸汽机2.0,实现人物口型等毫秒级同步,多版本升级且价格有竞争力。实测效果好,技术上解决难题,还开创应用驱动研发范式。