「数字人视频」共找到 2219 篇相关文章
刚刚,百度抛出“王炸”:全球首个可商用自我演化智能体!李彦宏:技术迭代速度是唯一护城河
在百度世界大会上,李彦宏指出产业结构不均衡问题,介绍AI产业从‘正金字塔’向‘倒金字塔’转变。百度展示内化AI能力成果,如发布数字人、重构搜索、更新秒哒等,还推出昆仑芯、文心大模型5.0和全球首个可商用自我演化智能体百度伐谋。
SkyReels-Audio让嘴型和音频完美匹配不再难
音频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度和时间一致性。
2025乌镇峰会看点:人工智能,中国数字世界秩序之巅
2025年世界互联网大会乌镇峰会是战略转折点,议程、展览等聚焦AI,从宽泛论坛变为展示AI驱动发展模式平台。报告剖析议程架构、战略差异,评估其对全球AI格局等多方面的影响。
一人公司创业,如何找对方法论、选准装备库?
AI让一人做产品更易,全国一人有限责任公司数量增长,相关服务生态成形。时踪由阿泰独立研发,从个人痛点出发做出产品,其95%云服务选阿里云。阿里云为OPC创业者提供阶段化“装备库”。
多模态思维链如何重塑 AI 与短视频的未来
传统多模态模型在动态视频理解与复杂推理场景面临挑战,快手开源的 Keye-VL 模型在多模态思维链技术实现突破。文章解析其核心技术,分享在快手短视频社区的落地应用,还探讨了未来“Think with Video”的技术方向。
这是我花9毛钱拍的《Meta老板砸钱把我从苹果挖走》
国产AI开启新Level,生数科技的Vidu Q1参考生视频功能,9毛钱+4张图就能生成视频。它重新定义叙事,砍分镜、拍摄等流程;有业内最强一致性;价格低,让AI视频生成“快、好、省”。
轻量高效,即插即用:Video-RAG为长视频理解带来新范式
现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。
清北浙领跑两院新院士候选!最年轻被提名人39岁
8月20日,中科院和工程院公布2025年院士增选有效候选人名单。清北浙领跑,最年轻候选人39岁。人工智能地位提升,机器人技术成优先支持学科,反映国家对新兴领域的重视。
快手高欢深度解读:多模态理解如何成为AIGC视频生成的“幕后功臣”?
2024 年 AIGC 爆发,多模态理解技术支撑 AIGC 原生应用。快手高欢在 AICon 大会分享多模态理解在 AIGC 场景应用,介绍主流 AIGC 产品形态,探讨其背后多模态理解方法、提升能力途径及赋能 AIGC 的方向。
比SOTA快9倍,谷歌DeepMind时空重建,把视频变成时空搜索引擎
谷歌DeepMind联合团队发布D4RT时空重建框架,颠覆传统视频转3D方法。它按需提问,像搜索引擎,处理动态视频高效。内部结构分编码、解码两步,速度快,还发明聪明收割机算法,在多项测试中表现优异。