游戏交互视频」共找到 1721 篇相关文章

开源动态8

准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源可商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的多模态视觉理解模型MOSS-VL。它能准确回答视频里可被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许可。

量子位
算法论文8

训练成本暴降99%,35秒出1分钟高清视频!英伟达MIT等引爆视频AI革命

英伟达联合MIT、港大团队提出SANA - Video架构,其核心是创新的全局线性注意力Diffusion Transformer训练框架和全局显存恒定的KV缓存机制。它训练成本低、速度快、可部署,重新定义AI视频生成效率极限。

新智元
新闻资讯7

李飞飞做AI游戏,拿了4个亿

李飞飞联创的AI游戏公司Astrocade获5600万美元A+B轮融资。该平台让用户用自然语言描述就能生成游戏,上线8个月有2000万用户、月1.4亿次游玩。其用专门AI模型降低创作门槛,未来发展待察。

量子位
新闻资讯7

The Batch: 937 |OpenAI 退出视频生成领域

OpenAI计划关闭视频生成器Sora,将资源重新分配到更有盈利性的投资中。Sora虽能生成高质量视频,但生成耗时久、计算成本高,日亏损约100万美元,其与迪士尼的合作也将结束。

DeeplearningAI
产品应用7

米哈游蔡浩宇,发了个“游戏版ChatGPT”

米哈游蔡浩宇上新AI聊天软件AnuNeko,用户反馈其人性化高但逻辑较弱。AnuNeko出自蔡浩宇新公司Anuttacon,该公司此前还推出实验性AI游戏。如今AI+游戏大势所趋,米哈游新游也加入更多AI元素。

量子位
算法论文8

UserBench 与 UserRL 带来的交互智能范式转向

当下大模型在与用户交互时存在不足,来自UIUC与Salesforce的UserBench和UserRL两篇新作,将‘用户价值’量化,把‘可测的交互’转化为‘可训练的策略’,从评测和训练层面推动模型向‘懂用户’转变。

深度学习自然语言处理
开源动态8

昆仑万维多模态视频生成开源,影音图文全统一

昆仑万维开源的SkyReels-V3,通过统一多模态上下文学习框架,实现参考图像生成视频视频持续扩展及音频驱动虚拟数字人功能,在视觉质量与指令跟随性上逼近闭源顶尖水平,为开源社区提供强大研究基座。

AIGC开放社区
产品应用7

互联网黑话之西游记版 AI 视频的制作方法

文章介绍互联网黑话之西游记版AI视频制作方法。先与AI共创剧本,以互联网黑话结合西游记场景为佳;再让AI根据剧本和人物形象图生成包含多内容的分镜脚本,生成首帧图后按脚本制作视频,不满意可反复生成再拼接。

宝玉AI
开源动态7

二创党福音!基于AI的开源智能视频切片处理系统

AutoClip是基于AI的开源智能视频切片处理系统,能自动从多平台下载视频、提取精彩片段并生成合集。适合UP主、内容创作者等,有多平台支持、AI智能分析等特性,部署方式简单。

GitHubStore
8

右兔短视频去水印工具正式上线!

右兔去水印工具,一键解析全网短视频,无需广告,免费下载,支持高清原画质。

孔学长