「多角色对话视频生成」共找到 1701 篇相关文章
生数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务
生数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。生数科技双轨布局,Vidu与MotuBrain同根。
对话MossCode:估值1亿美金的AI运动手表,想给用户构建一套「个人运动能力Context」
AI智能运动穿戴赛道正火,MossCode获数千万元天使轮融资,估值达一亿美元。其创始团队背景强大,想打破运动行业「苦难叙事」,用AI理解个体差异,为用户打造更贴合需求的运动手表。
独家对话前华为天才少年李元庆:首款规模化具身智能产品中国造!多机异构是未来方向
前华为天才少年李元庆加入乐享科技,负责创新业务与技术攻关。他指出世界首个体量化具身智能产品可能在中国出现,多机异构是未来方向,还谈具身智能发展现状、难题及应对策略,分享未来规划与建议。
每周产业洞察 | AI音视频赛道现“隐形冠军”小众需求催生健康商业模式,工程能力成盈利分水岭
北京AIGC视听产业创新中心位于朝阳区,是朝阳区推动影视制作基地建设举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚60余家合作伙伴。首创郎园拓展服务边界,项目延伸多地。
用2D数据解锁3D世界:首个面向运动学部件分解的多视角视频扩散框架
张昊等提出 Stable Part Diffusion 4D (SP4D) 框架,由 Stability AI 与 UIUC 联合完成。它能从单目视频生成多视角 RGB 与运动学部件序列,解决运动学部件分解及自动 rigging 问题,实验效果显著,被 Neurips 2025 接受为 Spotlight。
2025世界人工智能大会特别推荐!10国20多位艺术家邀你开启与AI的深度对话
2025世界人工智能大会特别推荐的‘提视造境:国际人工智能艺术文献展’,由上海民生现代美术馆主办,汇集10国20多位艺术家31件/组作品。分五大板块,探讨AI艺术多议题,是人机共演的艺术实验。
对话AutoCoder宿文:做5000万程序员的AI IDE,不如做10亿软件消费者的Vibe Coding
2025年AI Coding赛道火热,大厂纷纷布局。AutoCoder创始人宿文认为不应与大厂卷辅助编程,要走出差异化,做面向10亿软件消费者的Vibe Coding。团队迭代代码模型,产品数据表现佳,还分享了创业、产品、市场等多方面看法。
模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum
本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。
辛顿、杨立昆等 AI 先驱都源自信号处理——对话 IEEE 首位华人主席、美国双院院士刘国瑞 | 万有引力
本文是对IEEE首位华人主席刘国瑞的访谈。他分享了科研、创业经历,谈到AI先驱多源自信号处理,鼓励年轻人追梦,还探讨了科研模式、合成数据、AI应用及未来生活图景等话题。
AI若解决一切,我们为何而活?对话《未来之地》《超级智能》作者 Bostrom | AGI 技术 50 人
本文是对《未来之地》《超级智能》作者 Nick Bostrom 的访谈。他探讨了人工智能发展到解决一切问题的“已解决世界”时人类面临的意义危机,如失去目标、工作冗余等,也提及应对伦理挑战、寻找新意义等观点。