音视频一体化」共找到 1042 篇相关文章

新闻资讯8

神秘模型屠榜多日、碾压Seedance 2.0!背后竟是阿里大招:新部门首作实锤,引爆股价拉升

近日,神秘模型 HappyHorse-1.0 登顶 Artificial Analysis 视频模型排行榜。阿里巴巴确认其为 ATH-AI 创新事业部自研产品,正在内测,4 月 30 日上线 API。该模型技术亮点多,若开源或改变 AI 视频行业格局。

InfoQ
开源动态8

空间智能终极挑战MMSI-Video-Bench来了,顶级大模型全军覆没

上海人工智能实验室 InternRobotics 团队推出空间智能视频基准 MMSI-Video-Bench,对主流多模态大模型进行评测。该基准题型全面、问题具挑战性,视频数据多样,能针对性测评。结果显示模型与人类差距显著,明确了能力瓶颈。

机器之心
算法论文8

比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗

英伟达新研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握新动作、泛化到新环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。

新智元
开源动态8

港大开源ViMax火了,实现AI自编自导自演

香港大学黄超教授团队开源ViMax框架,在GitHub获高星标。它借助多智能体协作实现AI自编自导自演视频,突破主流模型在长视频制作的瓶颈,采用多种策略应对技术挑战,不过在多方面仍有提升空间。

机器之心
新闻资讯8

“代码 + 编译器”要消失了?马斯克在 xAI 全员会上放话:到今年年底,AI 或将直接生成二进制

xAI 近期出现离职潮,马斯克公开 45 分钟全员大会视频回应。他表示离职是阶段适配问题,强调速度是当前唯一优先级。还公布新架构,涉及 Grok、编程、图像视频、MacroHard 四条线,并预测 AI 未来发展,如年底或直接生成二进制。

InfoQ
新闻资讯7

永别了,Sora!奥特曼All in超级App

OpenAI一早关停爆火仅6个月的AI视频APP Sora,包括其开发者版本及ChatGPT内视频功能。奥特曼此举是为打造「超级应用」、为IPO铺路,同时为新模型Spud腾出算力,其预训练已完成,将在未来几周发布。

新智元
推荐文章7

从大厂设计师到超级一人公司:6000字回顾我和AI的2025

作者回顾2025年,身份从大厂设计师变为自由职业者,用AI加持做超级一人公司。自媒体上各平台粉丝量增长,开始做视频;社群活动帮创业者和会员;创作涵盖Vibe Coding、Agent、图像视频等;还介绍合作产品,展望2026年AI趋势。

歸藏的AI工具箱
开源动态8

本周推荐的6个超级6的Github开源项目!

本文推荐6个Github开源项目,包括Tabler(HTML仪表板UI工具包)、KrillinAI(AI视频工具)、Simple mind map(思维导图工具)、Sniffnet(网络流量监控工具)、Supabase(Firebase替代品)、FeHelper(开发者浏览器扩展),介绍了各项目特点与功能。

开源先锋
开源动态8

炫酷全能,一个窗口搞定所有,狂揽 1.5w 星!

Wave Terminal是开源跨平台终端应用,将命令行与图形化工具集成,操作在自由拖拽布局界面完成,减少上下文切换。有灵活布局、强大编辑器等特性,安装简单,创造全新高效工作流。

开源先锋
开源动态8

多模态开发革命!Gabber开源:图形化构建实时AI应用,效率提升10倍!

AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块化与图形化简化开发,有诸多特性,还给出安装指南,适用于多种场景。

开源星探