视频学习」共找到 2288 篇相关文章

算法论文8

IEEE TPAMI 2025 | 北京大学提出分布驱动的终身学习范式,用结构建模解决灾难性遗忘

北京大学周嘉欢与彭宇新教授合作在 IEEE TPAMI 发布研究成果 DKP++,针对终身学习的灾难性遗忘问题,提出分布建模引导的框架,增强历史知识记忆与跨域学习能力,代码已开源。

机器之心
新闻资讯7

Sutton、OpenAI 联创押注的持续学习,有中国团队带着模型进场了

7 月,TML 发布 Inkling 模型,Mind Lab 发布 Macaron V1,二者均针对持续学习场景。持续学习走「参数空间的迭代」路线,让模型用得越多越好用。硅谷已有不少新尝试,产业链正在形成。

Founder Park
开源动态8

13.8K star!!6G显存就能跑的AI视频神器,支持1分钟生成,这么6?!

现在AI视频生成领域仍面临高算力需求挑战,斯坦福大学研究团队推出`FramePack`项目,降低了本地AI视频创作硬件门槛,有低硬件需求、高效生成速度等特色,操作也简单。

开源先锋
产品应用7

用AI把一段视频变成可视化网页,Google的新模型又卷飞了。

Google将Gemini 2.5 Pro更新为05 - 06版,此版代码能力在WebDev Arena盲测竞技场登顶,还提升视频理解能力,可将视频变成可视化网页,虽产品有不足,但模型进步值得肯定。

开源星探
算法论文8

视频扩散模型新突破!清华腾讯联合实现高保真3D生成,告别多视图依赖

清华大学联合腾讯提出Scene Splatter,基于视频扩散模型,从动量视角引导其生成满足三维一致性的视频片段,提升三维场景生成效果,解决了传统方法在单张图片重建三维场景的难题。

量子位
算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。

AI科技评论
新闻资讯7

视频版Nano Banana来了!内置Gemini世界知识;原版香蕉出图仅需4秒

谷歌开放Gemini Omni Flash API,将多模态推理与视频生成编辑结合,有4项关键能力,也有局限。Nano Banana 2 Lite出图快且便宜。二者串联使用,图像生成与视频创作可无缝衔接。

量子位
产品应用8

AI视频生成走向「演技生成」时代,生数科技Vidu全球发布Vidu Q2

9月25日,生数科技全球上线新一代图生视频大模型Vidu Q2,打破AI生成表情假、动作飘忽等问题,实现从“视频生成”到“演技生成”跨越,有AI演技生动、镜头语言丰富等亮点,已多端上线。

机器之心
算法论文8

SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门

现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。

机器之心
开源动态8

14B规模竟也能单卡实时生成视频?多亏这个强大的开源底座

春节期间 Seedance 2.0 爆火,字节跳动等开源视频模型 Helios 家族,参数量 14B,单卡生成速度达 19.5 FPS。它与 UniWorld-OSP2.0 技术栈同源,后者是超百亿级视频生成大模型,有诸多技术突破。

机器之心