「视频制作流程」共找到 1788 篇相关文章
大模型全面爆发,所有榜一都是Gemini!谷歌一夜站到了台前
北京时间今日凌晨,Google I/O 2025 开发者大会开启。谷歌发布或升级系列 AI 工具与服务,如升级 Gemini 模型、推出编程智能体 Jules 等,还展示视频图像生成模型、搜索与购物模式升级,展现其在 AI 应用领域强势回归。
MMX-CLI给AI Agent装上七种感官,内容创作更方便
MiniMax发布的MMX - CLI命令行工具,给AI Agent装上七种新感官,具备图像生成、视频创作等能力,可一站式解决内容创作问题。它安装使用简单,功能多,还能集成到现有工作流,不过采用按量付费。
Meta 系 95 后华人明星团队,创业一年就与高通达成合作,让手机拥有多模态记忆
由华人创业者沈俊潇创办的 Memories.ai 发布 LVMM 2.0 并宣布与高通合作,该模型 2026 年将在高通处理器上原生运行。它解决视频可搜索性问题,应用广泛,能降低延迟、确保数据安全等。
世界模型有了开源基座Emu3.5!拿下多模态SOTA,性能超越Nano Banana
北京智源人工智能研究院的悟界·Emu3.5是最新最强的开源原生多模态世界模型,能处理图、文、视频任务,在多项权威基准上性能亮眼,还具备理解长时序等能力,背后有技术创新,且选择开源。
WaveSpeedAI 成泽毅:AI Infra 本来就是一门能挣钱的生意
WaveSpeedAI成泽毅本在大厂做Infra,后创业。他先在社区验证技术价值,创业首日就定全球化策略。WaveSpeedAI团队小而灵活,用利他思维合作,在视频生成领域降成本,验证了推理基建有市场。
Artificial Analysis 发布 2025 年 AI 现状 Q3 季报
Artificial Analysis发布2025年Q3 AI现状报告,揭示五大关键趋势,如推理模型占智能榜单前十、智能体能力突破、开源模型发布创新高、图像视频技术主流化、原生语音模型达生产级,还将举办简报会。
一句话生成任务专属LoRA!Transformer作者创业公司颠覆LLM微调
Transformer作者之一创立的SakanaAI推出Text-to-LoRA(T2L),简化模型适配流程,省却繁琐微调。T2L参数压缩率达80%仅降1.2%准确率,零样本场景平均准确率78.3%超现有SOTA方法,开启“一句话定制模型”时代。
第十一章 Deep Agents 实战——数据分析与报告生成
本章介绍构建营销内容 Agent,能分析产品数据、生成营销文案等。核心技术有结构化输出、多 Skill 水平组合、模拟数据分析。还对比传统营销与 Agent 流程,展示结构化输出优势及数据驱动决策方法。
记录下SGLang开发,优化,debug的技巧之大SKILL时代已来临
文章记录SGLang开发等技巧,介绍Agent在编程开发领域的强大能力,如完成多种工作、提升模型速度。还提及Agent流程优化方向,提醒警惕其偏差,指出人的价值转变,成为设计、把关和提炼者。
3.5k星星!用AI推演、预测未来,这个开源多体智能引擎做到了。
文章介绍开源多体智能引擎MiroFish,它是基于多智能体技术的AI预测引擎。用户提供种子文件、下达指令,它能构建数字沙盘,让AI智能体互动演化,可用于企业公关等场景,还给出推演流程。