「视频创作自动化」共找到 1647 篇相关文章
自然语言秒搜千级节点!阿里ComfyUI-Copilot开源:AIGC实时工作流一键生成!
在AIGC领域,ComfyUI虽强大但节点复杂。阿里团队开源ComfyUI - Copilot,通过自然语言交互增强工作流自动化,有节点搜索、工作流构建等功能,简化操作,提升效率。
中科院甩出多模态“核弹”!类GPT-4o多模态模型开源!支持语言-视觉-语音任意组合交互!
中国科学院计算技术研究所(ICTNLP)开源类GPT - 4o多模态模型Stream - Omni,支持文本、视觉和语音任意组合交互,核心是高效模态对齐技术,少量多模态数据即可训练,有多种使用场景。
实测腾讯Hunyuan-Image2.0,首个毫秒级实时图像生成模型
今天上午腾讯发布混元图像2.0,以“更智能、更开放、更中国”为理念。其参数规模提升,推理时间大幅压缩,实现毫秒级实时生成,还在画面质量等方面升级,新增实时绘画板功能。
ThinkingAI硅谷首秀,发布企业级Agent平台Agentic Engine|甲子光年
美国当地时间4月16日,ThinkingAI在硅谷举办发布会,宣布更名并发布企业级Agent平台Agentic Engine,还与Minimax达成合作。该平台有行动闭环、全域感知、私有化部署三项核心能力,能让系统替企业完成业务全流程。
Routa 桌面版发布:内建 Harness 工程的 AI Coding 研发协作工作台
Routa桌面版发布,它是内建Harness工程的AI Coding研发协作工作台。围绕Routa构建Harness工程框架,Kanban成为任务协议,多Agent沿泳道接力协作,重新定义了‘done’,让AI Coding进入协作与交付问题域。
重磅!iPhone 端侧可部署 Gemma 4 了!完全零token消耗!
PhoneClaw 是运行在 iPhone 的本地 AI Agent,可离线运行 Google Gemma 4。它支持多模态,有隐私保障和灵活模型管理。文中介绍使用方法、自定义 Skill 方式、常见问题,还提及后续扩展计划。
让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方
上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。
多模态开发革命!Gabber开源:图形化构建实时AI应用,效率提升10倍!
AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块化与图形化简化开发,有诸多特性,还给出安装指南,适用于多种场景。
大事件!天津美术学院·人工智能与艺术
天津美术学院举办‘重力重塑 - 2025人工智能与展演艺术工作坊’,作为新生入系‘供氧计划’,聚焦‘人工智能与展演艺术’。邀请国内外20余名多领域专家,还有三场workshop,旨在探索AI背景下艺术创作更多可能。
WorkSwarm:引领办公智能体新范式,让AI从一个助手,进化为一支与你并肩作战的团队
办公智能体成热门赛道,openJiuwen推出WorkSwarm蜂群办公智能体,将多智能体协作引入个人办公场景。它有单Agent和集群两种模式,能自主组队、共享成果等,还支持多平台,openJiuwen社区也在招募开发者。