「文档到演示视频生成」共找到 1371 篇相关文章
阿里开源14B电影级视频模型!实测来了:免费可玩,单次生成时长可达分钟级
昨夜阿里发布14B视频模型Wan2.2 - S2V,仅需一张图片和一段音频,就能生成电影级数字人视频。该模型发布即开源,可在通义万相官网免费体验,单次生成时长可达分钟级。
732M模型超越7B!机器人操控新范式:从视频中「悟」物理
机器人操控有「数据困境」,传统方法需大量人工标注动作演示数据。中山大学王广润教授团队从视频生成模型「借」物理直觉,提出PAR和PhysGen,与英伟达DreamDojo核心思路一致,验证了新的技术路线。
马斯克脑机接口意念控制机械臂!演示者获得钢铁之吻,理论上可控制一切
Neuralink官方视频中演示者已能用意念控制机械臂。升级实验将采用“双植入”方案,首位受试者或二次手术。受试者也主动探索新用法,2024 - 2025年Neuralink多项成果,下一阶段关注复杂神经功能。
「百万级」视频推理数据集!30+顶尖高校联合发布
AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。
73%人类认同率!Video-Bench实现视频质量精准打分
上海交大等团队提出视频评估框架Video - Bench,让多模态大模型‘像人一样评判视频’。它构建双维度评估框架,引入链式查询和少样本评分技术,与人类判断73%高相关,为视频生成模型优化提供标尺。
Cursor 内置三大文档工具,为AI 编程注入精准上下文
大模型编程易因知识陈旧致代码出错,为其提供实时上下文是关键。Cursor 有 @Docs、@Web、MCP 三大文档工具,能处理不同文档,还可协助创建和更新文档,弥合模型知识与项目需求的鸿沟。
哔哩哔哩献给二次元世界的礼物—AniSora,目前最强大的开源动漫视频生成模型
动画视频生成评估挑战大,现有模型处理动画视频力不从心。哔哩哔哩推出AniSora综合系统,支持一键生成多种动漫风格视频镜头,在角色和动作表现上出色,在多维度超越当前先进模型。
并行扩散架构突破极限,实现5分钟AI视频生成,「叫板」OpenAI与谷歌?
近日,CraftStory 推出 Model 2.0 视频生成系统,凭借并行扩散架构破解视频时长难题,可生成长达五分钟视频。其由 OpenCV 创建者 Victor Erukhimov 创立,此次突破或为企业带来商业价值,还计划开发新模型。
代码库的AI觉醒!GitMCP开源神器:实时文档中心秒级搭建,终结代码幻觉!
AI助手处理项目文档常“幻觉”频发,GitMCP这款开源工具通过MCP将GitHub仓库转变为实时文档中心,让AI直接访问最新文档和代码,消除“代码幻觉”。它功能强大,配置简单,应用场景广泛。
快手AI超级员工上线!一句话剪出完整短视频,从文案到发布一条龙
快手AIGC超级员工Kwali正在内测,可一句话生成完整短视频。它整合多Agent框架,有素材库和数字人资源。能完成脚本、拍摄、剪辑等环节,降低视频制作门槛,重构视频供应链。