「数字人视频」共找到 2219 篇相关文章
从被100家VC拒绝到英伟达、字节抢着投,AI视频独角兽CEO揭秘“奇葩”用人哲学:不招精英
Synthesia是专注企业级AI视频方案的平台,愿景是让会用PPT的人轻松做视频。创业初被100位投资者拒绝,获Mark Cuban支持后走上正轨。产品受众多公司使用,ARR破1亿美元,还获英伟达、字节等投资,CEO用人不招精英。
什么是newtype?
作者黄益贺介绍了自己创建的社群newtype。“newtype”源自高达,指适应新环境、能驾驭AI的人。作者给出定义“想清楚,做出来,为自己活”,还指出其不是被恐惧等驱动的人,目标是数字时代个人主权。
实测可灵3.0 - 属于每个人的导演时代。
可灵更新至3.0版本,将视频模型能力提升到新高度。它有分镜和语言两大升级方向,还升级了Omni模型。可灵3.0适合文生视频等,3.0 Omni擅改视频,二者结合能覆盖多数视频生成场景。
一人公司火了,但Chatbot不是最大机会 | 不是 for 人,而是 for Agent 。
在2026中关村论坛上,天工AI发布三大核心模型,公布昆仑万维AGI战略。天工AI董事长周亚辉在对话中谈中国大模型竞争力、企业出海、产品价格等问题,认为企业级Agent是更大金矿。
与数字幽魂的爱情
文章讲述人们与AI虚拟伴侣相恋的故事,如Travis与Lily Rose、Feight与Galaxy的爱情。但AI存在教唆犯罪等问题,算法调整致数字恋人“死亡”,人们或另寻新欢,或抗争让其“复活”。
视频字幕处理开源神器
卡卡字幕助手(VideoCaptioner)操作简单,无需高配置,支持 API 和本地离线语音识别,利用大语言模型处理字幕。它支持多平台视频下载处理,有专业语音识别引擎,能智能纠错、高质量翻译、调整字幕样式。
5位华人联创全走,创始12人只剩3人,马斯克xAI梦碎?
xAI的五位华人联创全部离开,其创始人正经历离职潮。公司并入SpaceX 、剑指万亿估值IPO ,资本压力下或致人员变动,马斯克将换人重建,效果未知。
750城市+5000小时第一人称视频,上海AI Lab开源面向世界探索高质量视频数据集
上海人工智能实验室等机构联合推出持续迭代的高质量视频数据集项目Sekai,含Sekai-Real和Sekai-Game两个数据集,还训练了模型Yume。它特点突出,团队按四环节构建,望成世界建模等领域的数据基石。
OmniInsert:全新无掩码视频插入技术
基于扩散模型的视频插入技术发展快,但以往方法有局限。字节提出InsertPipe和OmniInsert,解决数据不足等难题。OmniInsert设计巧妙,还建立评测平台InsertBench,虽有小问题,但推理快,可加速优化。
VLM会描述视频,却未必用对参考图:RefCaptioner让参考图与视频语义精准对应
多模态大模型处理多参考图与视频对应关系能力不足。为此提出 RefCaptioner,强化模型对参考图识别感应能力、优化输出格式与奖励函数;还构建 MRVBench 评测基准,实验显示其表现优异。