视频生成模型」共找到 8934 篇相关文章

产品应用8

OpenAI突然发布Sora 2:好一个“AI版抖音”!

OpenAI重磅上新,带来依托Sora 2的“AI版抖音”——Sora iOS APP。Sora 2是音视频同步生成模型,更遵循物理定律、可控性强,还能注入现实元素。实测效果佳但画质低,Pro版可改善,后续还会发布API。

量子位
产品应用7

3种主流AIPPT实现方式详解,最复杂的有开源方案。

文章介绍三种主流AIPPT实现方式。图片生成式能按需求画PPT,速度快成本低但难调整;网页编程式效果与模型和提示词相关,易调整、数据精准;模板式有盈利案例,用模板填内容,较可控但实现复杂,还有开源项目PPTAgent可参考。

开源AI项目落地
新闻资讯8

Gemini 3.5来了!今夜,谷歌亲手淘汰谷歌

谷歌I/O 2026大会火力全开,发布Gemini Omni、3.5 Flash、Spark等新品。Omni可接收任意输入生成视频,3.5 Flash性能强大,Spark是7×24h云端个人AI特工。谷歌多项能力同时到位,撕开了ASI入口。

新智元
推荐文章7

为什么我用了那么多提示词模板甚至用了 AI 帮忙还是写不好提示词?

现在很多人觉得模型强大,提示词工程没必要,但复杂需求仍需它。作者以写雷军演讲提示词和YouTube字幕生成提示词为例,介绍迭代创作过程,指出写不好提示词根源是难评估差距和调整。

宝玉AI
新闻资讯9

Jev爆火硅谷!哑巴AI卷疯14万开发者

ChatGPT核心发明人Diogo Almeida离职OpenAI后推出不会生成文字的大模型Jev,发布3天就被主流平台集成,14万开发者涌入内测,提出行业旧路径跑偏,打造只做决策的新型AI,主打极速低成本零幻觉。

新智元
推荐文章7

AI 编码 3.0:人机协作,正在走向多 Agent 协作系统化

文章指出AI编码正从2.0走向3.0,2.0解决生成问题,3.0则是执行系统。当Agent进入软件交付流程,协作需从经验驱动转向模型驱动,Kanban和Harness等工具也有了新角色,系统更强调验证和控制。

phodal
算法论文8

与Gemini Diffusion共振!首个扩散式「发散思维链」来了

西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型推理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型

机器之心
产品应用7

Sora 2干翻Veo 3?超全对比实测:会中文脱口秀,但体操翻车,附有效邀请码

OpenAI推出Sora2,可生成20秒1080p视频,在物理准确性等方面更优,还具备音画同步能力。文章对Sora2和谷歌Veo3进行多轮对比实测,涉及不同场景,也提及Sora2版权保护及App相关情况。

机器之心
新闻资讯8

空间智能爆发只需24个月?群核科技首席科学家唐睿预言:具身智能才是AGI终极形态 | 万有引力

群核科技首席科学家唐睿在访谈中表示,空间智能是具身智能基础设施,可解决其数据不足痛点。破数据瓶颈靠普及感知硬件,2D、视频与3D生成走向融合,空间智能爆点24个月内或随硬件突破到来。

AI科技大本营
产品应用7

即梦图片4.0来了,我整理了10个好用到爆的进阶玩法。

字节即梦图片4.0背后是seedream4.0模型,与NanoBanana性能相当,但支持直出4K图、自由控比例、文生图审美和可控性强,中文字生成领先。文章整理了它在虚拟模特、换装等10个方面的玩法。

数字生命卡兹克