「视频世界模型」共找到 8453 篇相关文章
WAIC机器人探展:我被全场最靓的崽「Moz1」种草了
2025 年世界人工智能大会上,千寻智能的人形机器人 Moz1 大放异彩。它搭载自研 VLA 模型 Spirit v1,具备强大泛化能力,硬件也有多项突破。千寻智能全栈自研技术,资本持续加码,有望推动具身智能商业应用。
2025-04-努力不是做好事情最重要的因素
作者分享个人生活、工作等多方面情况,提及播客发布,认为努力非工作做好的关键因素,深入探讨Agent在业务应用中的问题,还谈及视频更新、投资经历等,最后表示要审视目标、精简事务。
无法蒸馏的美国市场,谁在分食 Frontier Labs 百亿美金预算?
本文围绕美国数据市场展开,分析了数据赛道的投资判断、公司增长难题、需求结构、最新趋势等。指出数据虽重要,但外部数据公司份额难线性外推;真实世界数据成新热点,各细分领域格局和投资方向不同。
NeurIPS 2025 Spotlight | 选择性知识蒸馏精准过滤:推测解码加速器AdaSPEC来了
大型语言模型推理延迟高、开销大,推测解码可加速但依赖草稿与主模型一致性。佐治亚理工等团队提出 AdaSPEC 蒸馏法,过滤难学 token,提升草稿模型与目标模型对齐度,实验显示能提升接受率和推理速度。
缔造OpenAI的秘密,竟只有一个词!新智元十年峰会圆桌,七位大咖激辩
新智元十周年圆桌论坛上,七位嘉宾探讨通往AGI与ASI的关键问题,如智能核心、AI能效、游戏与AI关系等。他们认为AI发展超预期,语言是智能核心,实现ASI关键在能耗,还谈及芯片与人脑差距、物理世界发展慢等话题。
Meta「分割一切」进入3D时代!图像分割结果直出3D,有遮挡也能复原
Meta MSL实验室发布三维重建模型SAM 3D,其家族的两个新模型能将2D图像转为3D重建模型,性能优异。同时,此前投稿ICLR 2026的SAM 3也亮相,可克服传统模型局限,在多项任务中刷新SOTA。
MoE推理「王炸」组合:昇腾×盘古让推理性能狂飙6-8倍
在通往AGI进程中,MoE模型成大模型推理提效关键。华为推出Pangu Pro MoE 72B模型,经多方面优化,推理性能提升6 - 8倍。还采用多种策略和算法,在昇腾不同平台展现卓越性能,为大模型落地提供支撑。
微软这支神秘的华人AI团队加入腾讯混元,曝与裁员无关|独家
WizardLM项目创建者徐灿发文称团队离开微软加入腾讯混元。混元此前发布多款AI模型,WizardLM也发布过混元模型。该团队专注高级大语言模型开发,曾成绩斐然,但也面临模型部署挑战。腾讯大力投入AI,网友对此看法不一。
“参考生”之王回归:Vidu Q3持续进化,剧张力拉满|甲子光年
近期,AI视频公司生数科技的Vidu Q3正式上线参考生视频并全面升级。它能解决视频内容创作痛点,让爆款人设等稳定复现。在榜单上表现出色,经测试在多场景降本增效,提升了视频“剧张力”。
独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人
9月3日消息,原DeepSeek核心研究员魏浩然带队转入百度,任文心大模型多模态算法负责人。此前他在多模态与端到端OCR底层重构有突出成绩,这是百度布局青年顶尖研发人才的又一动作。