自动出图」共找到 1740 篇相关文章

算法论文8

ICCV 2025 | 基于时序增强关系敏感知识迁移的弱监督动态场景生成

北大王选所团队发表论文 TRKT,针对弱监督动态场景生成任务目标检测质量瓶颈,提时序增强关系敏感知识迁移方法,含关系敏感知识挖掘和双流融合模块,实验证明能提升场景生成质量。

机器之心
开源动态8

大模型首次直接理解代码:不用Agent自动修bug,登顶SWE-Bench开源模型榜单

蚂蚁开源新模型CGM,首创将仓库代码模态融入大模型,不依赖闭源模型和复杂Agent,仅需4步就能快速定位、生成补丁。它在多个测试基准中领先,技术论文等均已开源。

量子位
产品应用8

AI 画不是玩具,而是可以变成效率工具 | 豆包 P Seedream 4.0 效率场景挖掘

作者测试豆包PSeedream 4.0,发现它有对指令深度意理解等能力且中文支持好。还分享用其提升效率的场景,如制作封面、翻译片文字等,也给发掘AI应用场景思路和写画提示词方法。

宝玉AI
开源动态7

用Claude Code剪视频,自动去口癖、加字幕、调色,完全免费开源

browser - use团队开源Claude Code技能video - use,可自动去口癖、加字幕、调色等。它通过转录文本和按需视觉合成让LLM理解视频,有完整流水线和设计原则,还给使用方法。

AI寒武纪
开源动态8

谷歌最强AI,被港科大开源超了?让海外创作者喊「King Bomb」的P大杀器来了

像编辑与生成模型爆发,冲击Photoshop地位。港科大贾佳亚团队开源DreamOmni2,优化升级多模态指令编辑与生成能力,效果获海外创作者认可,还在实测中表现色,其采用创新技术方案构建多模态生成体系。

机器之心
开源动态8

5秒4张2K大!阿里提2步生成方案,拉爆AI生进度条

阿里智能引擎团队针对Qwen最新开源模型,将SOTA压缩水平从80 - 100步前向计算骤降至2步,速度提升40倍,5秒可4张2K高清大。已发布Checkpoint,集成到呜哩AI平台。文章还分析传统蒸馏方案问题并介绍团队改进策略。

量子位
产品应用7

让AI自动生成工作流

不会搭建工作流没关系,可让AI自动生成。如用Claude帮搭建n8n工作流,它生成JSON文件,复制粘贴到n8n配置节点即可用。介绍n8n特点,还讲了Claude自动生成n8n工作流的操作步骤。

newtype AI
算法论文8

VLM会描述视频,却未必用对参考:RefCaptioner让参考与视频语义精准对应

多模态大模型处理多参考与视频对应关系能力不足。为此提 RefCaptioner,强化模型对参考识别感应能力、优化输格式与奖励函数;还构建 MRVBench 评测基准,实验显示其表现优异。

机器之心
算法论文8

SentGraph:一句一句把多跳RAG“画”成

传统RAG在多跳场景易‘断链’,因检索单元太胖、逻辑关系乱。SentGraph把检索单元缩到句,按逻辑画三层。线下建分拆句、找关系、架桥梁;线上推理有Anchor初选、精炼及路径扩展。实验提升显著,也有局限。

PaperAgent
推荐文章7

鹅厂员工怎么看Agent自动持续进化?

落地一个Agent容易,但让其自动持续优化很难。文章分享了9位鹅厂同事对“Agent如何自动持续进化”的看法,如建立评估体系、记录真实任务反馈、结合强化学习等。

腾讯技术工程