数字人视频」共找到 2219 篇相关文章

产品应用7

实测Gemini图片转视频新功能,终于蹲到经典梗图后续了(doge)

Gemini接入带声音的图片转视频功能,作者实测该功能。用开盒指令测试,生成速度较快;还尝试给梗图加后续,发现生成精确内容需详细提示词,且不能生成具体真形象内容。

量子位
算法论文8

无需训练,即插即用,2倍GPU端到端推理加速——视频扩散模型加速方法DraftAttention

高质量视频生成任务中,扩散模型成主流,但DiT模型注意力机制计算量大,成推理瓶颈。现有加速法效果不佳,为此美国东北大学等团队提出DraftAttention,可2倍加速推理且不损画质。

机器之心
新闻资讯8

仅428天!OpenAI首曝Sora内幕:85%代码竟由AI完成

OpenAI团队揭秘安卓版Sora APP构建内幕,4团队28天完成从0搭建,约85%代码由AI智能体Codex完成。Codex可自我迭代,在多方面表现出色,但也需类指导。团队分享了与Codex协作的经验和技巧。

新智元
开源动态8

ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑多模态

滑铁卢大学与快手可灵团队提出 UniVideo,是支持视频理解、生成与编辑的多模态模型。它采用双流架构,结合 MLLM 与 MM - DiT 能力,统一 10 个多模态任务,在多项基准超现有方法,代码已开源。

机器之心
新闻资讯7

小扎高薪挖来的又跳回OpenAI了!首席科学家赵晟佳也要回去

扎克伯格高薪挖组建Meta超级智能实验室,对标OpenAI和Google DeepMind。但刚挖来的有回流,老员工也出走,涵盖多岗位。重组致管理混乱,华尔街质疑720亿美元AI投资回报。

量子位
产品应用8

AI 模特时代到来:字节x清华推出商用级视频换装模型DreamVVT,保真度显著领先SOTA

字节跳动智能创作团队联合清华推出视频换装模型DreamVVT,基于Diffusion Transformer构建,用两阶段设计解决复杂场景痛点,支持多种输入,在保真度和时序稳定性上领先SOTA。

机器之心
推荐文章7

对话 Roto:让视频实时可交互、足够个性化,我们要做 AI 时代的 Netflix

Roto定位是全球首个互动开放世界视频平台。创始David Xu曾就职独角兽企业,涉足多模态生成。团队经多次方向调整,决定大胆探索极致创新。目前产品技术不成熟,但已探索新内容形式,还将在广告实现商业闭环。

Founder Park
新闻资讯8

程序员不许写代码!OpenAI硬核实验:3指挥AI,5个月造出百万行

OpenAI官博曝光内部实验,3团队利用Codex智能体5个月造出百万行代码产品,类不写代码,精力放于规划规则。此实验颠覆软件工程定义,宣告手工代码时代终结,也重塑程序员岗位。

新智元
新闻资讯7

众安信科参与打造宠物数字身份证 重磅亮相2025外滩大会 | 甲子光年

2025外滩大会上,众安保险与众安信科联合推出“NFT宠物数字身份证”外滩大会限定款,将RWA代币化技术与宠物健康管理结合。众安信科深度融合RWA与AI技术,打通宠物服务全链路,构建新生态。

甲子光年
新闻资讯7

刚刚,OpenAI全员放假一周!被Meta高薪连挖8「偷家」,真麻了

生成式AI竞争激烈,OpenAI却宣布全员放假一周,原因是被Meta高薪连挖8。OpenAI高管承诺正面交锋,Mark Chen称不会袖手旁观,还鼓励员工留下,公司更专注实现通用工智能。

机器之心