「自回归视频生成模型」共找到 2847 篇相关文章
【访谈】在黑箱中寻找自我显影——对话苏仲尧|三影堂厦门
苏仲尧个展《打开黑箱说亮话》聚焦摄影人机互动,引向对‘技术黑箱’思考。创作分三阶段,从文字照片到金属板,再结合AI。他将创作主导权回归自身,借作品探讨技术与人关系及当下处境。
别只用AI写脚本了,现在AI打广告可真是城会玩了!
如今广告玩法新颖,AI能识别短剧画面插入广告,还能生成贴合IP的番外短片。巨量引擎升级的品星云AI营销,打通“洞察 - 创作 - 投放 - 复盘”全流程,重构AI营销玩法,让决策回归简单。
Skills的最正确用法,是将整个Github压缩成你自己的超级技能库。
文章指出重复造轮子不可取,Skills可将Github开源项目封装成技能库。以FFmpeg、yt - dlp等为例,介绍封装流程,还提及多场景应用,如视频下载、格式转换等,让普通人能利用开源成果。
Ilya 最新访谈,预训练时代终结后,AI行业来到了哪里?
Ilya接受90多分钟深度访谈,指出当前大模型泛化能力远不如人,Scaling时代终结,研究时代回归。还谈到AI经济影响与跑分不匹配、泛化能力鸿沟、情感价值等问题,预测超级智能5 - 20年到来。
Sora 2数手指翻车,奥特曼成第一批「受害者」,被AI玩成最惨打工人
Sora 2虽强大,但数手指测试翻车,模拟场景也有瑕疵。奥特曼成其首批“受害者”,AI生成视频将他玩坏。同时,OpenAI研究员对Sora应用发布存担忧,而奥特曼解释资金投入原因。
又来了!OpenAI 发布 Sora 2,同时推出 AI 版Tiktok
9月30日,OpenAI发布新一代视频生成模型Sora 2,相比Sora 1有显著提升。同时推出iOS社交应用Sora,类似TikTok。应用有安全措施,已在美加iOS平台邀测。社区反应两极分化,OpenAI野心大但或面临挑战。
实测Perplexity Pro平替模型,免费开源仅4B
一款仅4B大小的开源模型Jan-v1,声称能平替Perplexity Pro,且完全免费、支持本地部署。实测发现,它在检索增强生成、上下文深度分析等能力上表现不错,入门级显卡即可带动本地部署。
从高考到实战,豆包大模型交卷了
火山引擎原动力大会 Force 2025 发布豆包大模型 1.6 等多项新产品。豆包 1.6 性能提升,在多方面表现出色;Seedance 1.0 Pro 视频生成能力强。大会强调‘AI 云原生’,还推出多个套件和技术进展。
李飞飞World Labs双模齐发,能「造」超复杂大场景,一手实测
李飞飞的 World Labs 推出 Marble 1.1 和 Marble 1.1-Plus 两款模型。Marble 1.1 提升视觉效果,Marble 1.1-Plus 能生成更大更复杂场景。官方建议初用选 Marble 1.1,创建大场景用 1.1-Plus,还给出了实测和网友案例。
对标GPT-4o和香蕉!浙大开源ContextGen:布局身份协同新SOTA
浙江大学ReLER团队开源ContextGen框架,攻克多实例图像生成中布局与身份协同控制难题。基于Diffusion Transformer架构,用双重注意力机制实现布局精准锚定与身份高保真隔离,在基准测试中超越开源SOTA模型,对标GPT - 4o等闭源系统。