互联网视频数据」共找到 3397 篇相关文章

算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。

AI科技评论
产品应用8

人人可用、真能落地,阿里用Agent掀翻了数据分析的牌桌

文章介绍阿里全资子公司瓴羊升级“智能小 Q”,这是阿里在数据分析赛道的首份 Agent 答卷。分析了数据分析从可视化、可决策到可行动的三阶跃迁,阐述智能小 Q 在准确性、企业级能力、价值增量方面的表现及应用案例。

InfoQ
新闻资讯7

视频版Nano Banana来了!内置Gemini世界知识;原版香蕉出图仅需4秒

谷歌开放Gemini Omni Flash API,将多模态推理与视频生成编辑结合,有4项关键能力,也有局限。Nano Banana 2 Lite出图快且便宜。二者串联使用,图像生成与视频创作可无缝衔接。

量子位
新闻资讯7

营收破亿,光轮智能完成数亿元 A 及 A+轮融资,揭秘机器人「数据荒」背后的生意经

近日,光轮智能完成数亿元 A 及 A+轮融资,已与全球头部企业合作,年营收破亿。其创始人谢晨博士指出机器人基础模型开发存在数据短缺问题,光轮通过仿真环境生成数据,是 NVIDIA 生态核心伙伴。

Founder Park
8

Cloudflare CEO 警告:未来两年,Agent 会让互联网每周爆出一个 Log4j

Cloudflare CEO Matthew Prince在播客中指出,互联网上Bot流量已超人类,未来五年或暴涨1000倍,旧商业模式将崩塌。他还谈到AI对安全、工作的影响,以及公司转型、互联网未来商业模式等问题。

InfoQ
算法论文8

博士答辩PPT分享 | 高雷诺数湍流场数据同化与湍流模型机器学习研究

西北工业大学孙旭翔博士的论文聚焦航空航天湍流模拟难题,结合数据驱动与同化方法,构建全流程框架,提出数据同化与模型修正方法,设计集成框架,实现高雷诺数复杂流动精确高效模拟。

力学与人工智能
产品应用8

AI视频生成走向「演技生成」时代,生数科技Vidu全球发布Vidu Q2

9月25日,生数科技全球上线新一代图生视频大模型Vidu Q2,打破AI生成表情假、动作飘忽等问题,实现从“视频生成”到“演技生成”跨越,有AI演技生动、镜头语言丰富等亮点,已多端上线。

机器之心
算法论文8

大模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了大模型训练的数据依赖难题。

新智元
开源动态8

14B规模竟也能单卡实时生成视频?多亏这个强大的开源底座

春节期间 Seedance 2.0 爆火,字节跳动等开源视频模型 Helios 家族,参数量 14B,单卡生成速度达 19.5 FPS。它与 UniWorld-OSP2.0 技术栈同源,后者是超百亿级视频生成大模型,有诸多技术突破。

机器之心
推荐文章8

10万引普林斯顿刘壮最新访谈:架构没那么重要,数据才是王道

普林斯顿大学助理教授刘壮在访谈中指出,架构没那么重要,数据、规模和记忆才是决定AI成败的关键。他认为ConvNet和Transformer性能差异源于训练细节;当前数据集远不够多样;大语言模型有语言空间的世界模型,但视觉空间的还缺失;记忆是瓶颈,智能体只是权宜之计;AI目前还替代不了研究生。

量子位