文生视频技术」共找到 3597 篇相关文章

产品应用8

面壁MiniCPM-V4.5新王炸!8B手机10FPS长视频秒懂,文档手写全能识别!

面壁上新最强端侧多模态模型MiniCPM-V 4.5,基于Qwen3 - 8B与SigLIP2 - 400M构建,总参数量8B。它视觉语言理解强、手机能跑,有高帧率视频理解等特点,还有多方面技术亮点。

CourseAI
新闻资讯8

李飞飞团队发布新一代世界模型Atlas:从零训练,一次性打通视频生成、 3D重建与机器人仿真

李飞飞创办的 World Labs 发布新一代世界模型 Atlas,称其为‘全球首个多模态世界模型’。它从零训练,能同时完成视频生成、3D 重建和时空模拟,已向少数伙伴开放测试,未来将成 Marble 底层模型。

DeepTech深科技
算法论文8

公里级场景也能稳住了,国产团队把长视频3D重建又往前推了一步

浙江大学、地平线机器人和之江实验室的新工作 Scal3R 要解决长视频 3D 重建问题。它借助 test - time training 技术,设计全局上下文模块和同步机制,提升长序列重建稳定性和精度,能处理超万帧几千米的场景。

机器之心
新闻资讯8

又一华为天才少年入局具身创业!用视频生成数据训家用机器人,首个模型登顶具身基模榜单

又一华为天才少年周凯文加入具身创企诺因智能。该公司成立不到一年,专注ToC家用具身智能机器人,用视频生成数据训练模型,其KnowinBrain模型登顶具身基模榜单,团队人才密度高。

量子位
产品应用8

刚刚,阿里「欢乐马」正式上线,抢先实测这匹「黑马」

4月27日,阿里ATH团队上线视频生成模型HappyHorse 1.0。它依托多模态架构,音视频创作编辑一体,价格实惠。支持文生、图生、多图参考生视频视频编辑功能强大,能精准替换主体、添加元素、改变风格。

机器之心
产品应用7

童年的滚球兽「走进」现实?华为天才少年创业,全球首个虚实融合的实时交互视频模型来了

Xmax AI 推出全球首个虚实融合实时交互视频模型 X1,通过手机摄像头实现虚拟与现实融合。它有四大玩法,操作简单。但面临多技术挑战,Xmax AI 团队实力强,给出硬核技术方案,愿景是让 AI 融入生活。

机器之心
算法论文8

上下文记忆力媲美Genie3,且问世更早:港大和可灵提出场景一致的交互式视频世界模型

交互式长视频生成缺乏稳定场景记忆,制约下游应用落地。Google DeepMind的Genie 3有强场景一致性但未公开技术细节。港大和可灵提出的Context as Memory模型,上下文记忆力媲美Genie 3且投稿更早,还提升了计算效率。

机器之心
产品应用7

谷歌向左、李飞飞往右,阿里世界模型「快乐生蚝」杀出第三条路

阿里推出世界模型HappyOyster(快乐生蚝),基于原生多模态架构,有漫游和导演两大核心功能,可实时构建和交互。与文生视频模型不同,它能随时被干预。虽世界模型尚处早期,但应用场景广泛。

机器之心
新闻资讯8

我国科研团队,突破了存算一体技术瓶颈

AI浪潮倒逼半导体产业创新,存算一体技术应运而生。但该技术应用存在问题,排序难题制约其发展。北大团队国际首次实现基于存算一体技术的高效排序硬件架构,成果发表在《自然∙电子》。

芯师爷
开源动态8

「百万级」视频推理数据集!30+顶尖高校联合发布

AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。

新智元