「视频功能」共找到 2391 篇相关文章
AI智能体加持,爆款视频产出速度提升了10倍,全民导演时代已来
Video Ocean在影像创作领域带来革新,通过AI Agent实现一人完成多职能,将拍摄周期大幅缩短。它打造自动化创作生态,能快速批量生成爆款视频,覆盖多种创作场景,操作简单,打破创作壁垒。
从 “可用” 迈向 “好用”:详解火山引擎智能视频云的三层架构升级|甲子光年
2025年AI关键在多媒体领域,智能多媒体落地有变革也面临挑战。火山引擎提出智能视频云三层架构升级,即基建、平台、应用层升级,助企业实现低成本、高效率规模化应用,多行业已基于此打造能力。
NUS、牛津等联合发布音视频智能综述:系统梳理大模型时代的AVI全景图
NUS领衔近10家机构发布音视频智能综述,系统梳理大模型时代AVI发展全貌,涵盖感知、生成与交互,复盘子方向工作,构建任务蓝图,整理评测体系,总结基础技术,还探讨应用、安全及未来研究方向。
从0到1拆解FreeWheel ChatBI:大模型如何重塑视频广告智能数据分析新生态
本文结合 FreeWheel 实际应用经验,分享构建 ChatBI 系统核心实践。介绍其核心功能、技术实践,如让 LLM 理解业务、智能选表等,还提及系统架构、算法服务,最后总结上线效果并展望未来优化方向。
AI狂飙100天,中国力量突起!顶流视频号10分钟看尽全球最强杀招
2025年开年,全球AI版图重绘,从中国DeepSeek开源风暴到OpenAI闭源反击,双方在算力、模型等层面激烈碰撞。各月双方均有新动作,4月AI迈入全民普及,新智元联合视频号推出活动助掌握科技风向。
视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系
香港大学、香港科大与腾讯ARC Lab联合提出SCoPE,让视频模型处理位置关系的基底从张量网格转向射线空间。它将相机射线坐标注入Video DiT,新增参数不到原模型0.1%,多方面表现获改善。
谷歌AI试穿神器真神了!上传照片秒出OOTD,视频效果和照镜子没区别
谷歌推出应用Doppl,上传照片就能看到衣服“穿”在自己身上的效果,还能生成动态视频。它不仅能试穿,还会帮忙搭配。此外,Google Labs还有Portraits、文生视频产品Flow等小实验。
Anthropic 为 Claude Code 添加了沙箱和 Web 访问功能,以实现更安全的 AI 驱动编码
Anthropic为Claude Code发布沙箱功能及基于Web的工具版本,解决编码安全风险。沙箱有文件系统和网络隔离两个边界,能减少权限提示、增强保护,还解决了传统安全系统的限制。
阿里再开源,全球首个MoE视频生成模型登场,电影级美学效果一触即达
继上周开源三连发后,阿里昨晚开源全球首个 MoE 架构视频生成模型 Wan2.2,具电影级美学控制能力。它有 MoE 架构创新等四大技术亮点,可在 Hugging Face 和阿里魔搭社区下载。
首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒
新加坡国立大学等联合发布EgoTwin框架,首次实现第一视角视频与人体动作联合生成,攻克视角-动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决难题,实验性能超基线。