「编辑文字」共找到 326 篇相关文章
免费AI办公套件真香,节省一大笔会员费
Genspark团队开源AI办公套件GenOffice,全平台免费无广告。它界面类似微软Office,零成本上手,AI能直接编辑文档。虽处Alpha阶段,但可切换多种模型,还给出了配置第三方模型的方法。
AI生图大洗牌!流匹配架构颠覆传统,一个模型同时接受文本和图像输入
AI生图有新突破,新模型FLUX.1 Kontext用流匹配架构,与此前技术不同,能接受文本和图像输入。其来自Black Forest Labs,有编辑和生成能力,还具备4个特性,第三方测试也给出提示词使用技巧。
GitHub连续霸榜,难怪别人的图表这么高级优雅!
作者让AI画系统架构图效果不佳,朋友推荐diagram-design项目。它是给Agent用的出图技能包,能让AI生成编辑级质量图表,有多种图表类型,具备诸多亮点功能,还介绍了安装使用方法。
最强AI PPT Skill!小白3分钟做大片感演示稿
本文介绍了鲸格PPT Skills,它是语义驱动的静态演示系统。区别于多数AI PPT工具,它先理解内容语义再呈现,支持多格式输出,有独特架构、动效和审美规则,生成的PPT可编辑、交互性强。
李飞飞团队新作:DiT不训练直接改架构,模型深度减半,质量还提高了
本文介绍「嫁接」技术,可在小计算预算下编辑预训练 DiTs 探索新架构。不从头训练,替换算子创建混合架构,保持质量同时减少计算量。还通过实验展示该技术在构建高效架构和文生图模型中的效果。
谷歌深夜双发!最便宜Nano Banana来了
谷歌深夜上线Nano Banana 2 Lite和Gemini Omni Flash。前者是最快最便宜文生图模型,4秒生图且成本低;后者是视频生成模型,支持多模态输入和对话式编辑。二者串联打通创作流水线,还集成SynthID水印技术。
蚂蚁集团扩散大语言模型新突破:超800Token/s,速度与质量兼得
蚂蚁集团将LLaDA更新到2.1,通过引入“草稿 - 编辑”机制,打破扩散模型推理速度与质量的对立僵局。它有极速和质量两种模式,还采用混合训练流程及强化学习,在多基准测试中表现出色。
湾大北交大开源 CutClaw,自动踩点音乐的 AI 智能视频剪辑师!
大湾区大学GVC实验室和北京交通大学团队开源CutClaw,它是模拟专业后期流程的多智能体系统,能实现音乐驱动剪辑,按文字指令自动剪辑,适配多平台,还可解构素材。操作简单,支持多模型。
图像编辑新神器:英伟达用拍电影思维解决图像编辑与世界模拟一致性难题
AI图像编辑物理一致性难题待解,现有方法易产生违反物理定律的漂移编辑。英伟达和多伦多大学提出ChronoEdit框架,将图像编辑视为拍微型电影,借助视频生成模型的时间连续性知识解决问题,在实验中表现卓越。
能导出 PSD 的 AI 设计工具,出现了
国内 Seede AI 团队发布海外新产品,无需写咒语,填文案信息就能让 AI 搞定排版等。它生成可编辑源文件,适合有内容但不会设计的人,还支持多格式导出,不过不擅长创意生图。