「轨迹匹配」共找到 204 篇相关文章
大模型推理学习新范式!ExGRPO框架:从盲目刷题到聪明复盘
上海人工智能实验室等团队提出经验管理和学习框架ExGRPO,能科学管理经验。与传统RLVR方法比,它在不同基准提升性能,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供新思路。
ChatGPT架构师,刚发布了最新研究成果
Thingking Machines发布第三篇研究博客,核心作者是OpenAI联创John Schulman。研究关于LoRA参数高效微调方法,探究其匹配全量微调效率的条件,给出简化调参方案,还提炼出三个核心发现。
真实场景也能批量造「险」!VLM+扩散模型打造真实域自动驾驶极限测试
浙江大学与哈工大(深圳)联合推出SafeMVDrive,将VLM关键车辆选择器与两阶段轨迹生成结合,可在真实域批量制造高保真安全关键视频,用于端到端自动驾驶系统安全性测试。
ICCV 2025|降低扩散模型中的时空冗余,上交大EEdit实现免训练图像编辑加速
上海交通大学EPIC Lab团队提出EEdit框架,入选ICCV 2025。它是首个加速匹配流模型图像编辑框架,能兼容多种引导方案,免训练,速度较原始工作流快2.4倍,支持多类型编辑任务。
AI窗口期只剩3-4年,98%的企业却高估了自身的技术成熟度
麻省理工学院报告显示,企业级AI试点仅约5%进入生产环节并产生回报。多数企业高估自身AI成熟度,落地难源于技术与组织发展速度不匹配。企业需系统重构,窗口期只剩3 - 4年。
视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系
香港大学、香港科大与腾讯ARC Lab联合提出SCoPE,让视频模型处理位置关系的基底从张量网格转向射线空间。它将相机射线坐标注入Video DiT,新增参数不到原模型0.1%,多方面表现获改善。
对话刘靖康:镜头之外的「智能」和「审美」,才是 Camera Agent 的主战场
影石 Insta360 创始人刘靖康在 AGI Playground 2026 上提出未来影像设备“前轻后重”趋势。他介绍了 Cameraman 愿景,涵盖 Imaging、AI、Robotics 三技术方向,还提到云端 AI 剪辑服务情况及对行业多方面的见解。
李飞飞第一篇「触觉」论文:机器人会盲摸麻将了
李飞飞等全明星阵容关注灵巧手研究,提出T-Rex模型。其通过给触觉单独开通路等方式解决触觉加入难题,在真实任务中表现出色,还为灵巧手领域带来从机身分化、启发专用场景应用等变化。
「熟悉的陌生人」才是「好老师」?复旦提出简单指标,找出推理蒸馏中真正有教学价值的数据
复旦大学和上海人工智能实验室研究者提出 Rank - Surprisal Ratio (RSR) 度量方法,综合考虑样本信息量与对齐程度,在蒸馏实验中与学生模型后训练性能相关性高,可用于筛选推理轨迹和选择教师模型。
让YOLO飞起来:从CPU到GPU的配置指南
文章指出默认安装的YOLO用CPU计算,处理大量图像或实时检测任务效率低。详细介绍将YOLO从CPU模式切换到GPU模式的步骤,对比性能,还给出常见问题解决办法,能显著提升运行效率。