「动态SBP利用策略」共找到 730 篇相关文章
CVPR 2026|1分钟单图变4D视频!AI看图直接脑补物理规律
北京理工大学和理想汽车等团队提出全新框架PhysGM,引入DPO实现端到端快速前馈推理,能1分钟内将单图生成为4D动态视频,在速度和评价指标上超越主流模型,相关工作被CVPR 2026接收且代码已开源。
揭秘!腾讯如何训练多智能体像专家一样设计游戏场景
腾讯游戏提出游戏场景自动布局生成系统IntelliScene 2.0,利用图像引导生成3D场景。它构建多智能体工作流,结合高质量数据集,经模型微调、视觉解析等步骤生成场景,经评估效果良好,为AI生成三维信息提供新路径。
理想的眼镜,和李想的眼界
今年11月,李想称要让理想成具身智能领域最佳企业。一周后,理想发布AI眼镜Livis。Livis解决了轻便、续航与性能的矛盾,还利用造车积累实现资产复用。理想推它是因AI眼镜潜力大,能输出跨场景AI能力。
鼠标的未来是手环?解码肌肉信号,Meta黑科技登上Nature
Meta推出非侵入性神经肌肉交互系统,利用手腕表面肌电图(sEMG)实现人机交互,该技术登上7月24日的Nature。实验在连续手势控制、离散手势控制和打字三个任务评测效果不错,适合特殊人群,也能弥补脑机接口数据不足。
“导演梦”不再遥远:Captain Cinema 让你用短片制作出电影
约翰·霍普金斯大学与字节Seed团队推出自动生成短片的Captain Cinema系统。它以剧情文字为输入,先规划关键帧,再补全画面动态合成短片。采用特殊训练法和模型,虽有局限,但为电影自动生成迈关键一步。
从 AI 招聘到数据标注,Mercor 能否打造下一个 Scale AI?
Mercor 从 AI 招聘平台转型为数据标注服务提供商,与 Scale AI 竞争。它利用早期人才招聘积累,为小规模、高难度项目提供灵活方案,虽数据质量待提升,但增长快,2025 年初 ARR 达 7500 万美元,获 1 亿美元 B 轮融资。
对谈黄灯:普通二本学生的出路在哪里?
高考季,与《我的二本学生》作者黄灯对谈二本学生出路。指出学历非唯一,能力和热情更重要。当下就业严峻,高校课程与社会需求脱节,二本学生应提升动手能力,利用AI工具,立足学校和当地找机会。
打破具身世界模型可执行性鸿沟 !港中深-跨维智能团队提出EVA框架,用强化学习让视频世界模型真正“动”起来
近期,利用视频生成模型为机器人构建“世界模型”成热门路线,但存在“可执行性鸿沟”。港中深 - 跨维智能团队提出 EVA 框架,用强化学习优化视频生成,实验显示其能提升视觉规划、仿真任务成功率及真实部署稳定性,还有数据合成潜力。
Prompt、Skills、MCP:大模型上下文工程核心链路
文章聚焦大模型上下文工程,介绍了Prompt、Skills、MCP核心链路。Prompt是与模型沟通基础,但其有脆弱、难管等痛点,促使向上下文工程演进;Skills是能力单元,可显式化能力、动态组合;MCP解决能力集成问题,虽有争议但理念重要。
西湖大学修宇亮:数字人重建,慢慢都会变成基础模型的微调任务 | GAIR 2025
12月13日,西湖大学修宇亮在GAIR 2025分享数字人重建进展。其团队成果UP2You将建模时间从4小时缩至1.5分钟;ETCH获更准确内部人体结构;Human3R可实时动态重建人物场景。他认为未来数字人重建将成基础模型微调任务。