多尺度生成」共找到 5656 篇相关文章

算法论文8

Snapchat提出Canvas-to-Image:一张画布集成 ID、姿态与布局

Canvas-to-Image 是面向组合式图像创作的全新框架,将不同控制信息整合在同一画布,简化图像生成控制流程。它解决了传统生成流程中控制方式分散的问题,能在推理阶段组合种控制信号,实验效果良好。

机器之心
算法论文8

让RAG真正读懂“言外之意”!新框架引入词汇样性,刷新项基准SOTA

ACL 2025研究提出Lexical Diversity - aware RAG (DRAG) 框架,将词汇样性引入RAG检索与生成,解决现有方法痛点。它有两大创新模块,实验在基准提升准确率,还将在模型上增益,代码即将开源。

量子位
产品应用8

AI生图迎来大升级:图像编辑达到像素级!背后团队大来自Stable Diffusion模型基础技术发明团队

Stable Diffusion缔造者团队创立的 BFL 发布全新图像生成模型 FLUX.1 Kontext,可实现像素级图像编辑。它能以文本和图像为输入,有 Pro、Max、Dev 三版本,已在平台上线,获用户好评,但也面临竞争。

AI前线
算法论文7

好玩!AI模仿人类‘空像错觉’,开启想象力之旅

越南国立大学提出Shape2Animal框架,模仿人类‘空想性错觉’,将自然物体轮廓转化为动物图像。该框架经阶段流程,结合种技术生成画面,但也继承了基础模型的一些局限性。

带你学AI
产品应用8

实测对比!扣子空间播客功能完爆 NotebookLM,覆盖场景更大

模态是大模型热门应用概念,文本生成语音赛道受资本青睐。作者实测对比扣子空间和NotebookLM,发现扣子空间播客功能更优,能精准拿捏尺度,覆盖场景大,还能做旅行攻略、生成网站等。

InfoQ
开源动态8

阿里开源Qwen3-Coder-Next,80B参数仅激活3B的MoE顶尖编程助手

阿里开源小型MoE代码模型Qwen3 - Coder - Next,总参数量800亿但仅激活30亿参数,在代码生成等任务表现出色。团队构建训练技术栈解决数据匮乏,模型训练分阶段,领域专家模型能力整合,基准测试性能强劲。

AIGC开放社区
算法论文8

AMS | 西工大董戴玮、张伟伟等:求解偏微分方程的残差级联极限学习机

本文设计残差级联极限学习机(RC - ELM)缓解极限学习机(ELM)求解偏微分方程的病态问题。将个ELM块级联,配备相同隐藏层,传递残差求解。实验显示,相比经典ELM,RC - ELM精度优势显著,误差降约4个数量级。

力学与人工智能
产品应用8

AI视频进入蒸汽机时代

百度蒸汽机 2.0 迎来重磅升级,推出行业首个通用 AI 长视频生成功能,突破时长限制,引入交互式需求表达功能。它解决了传统视频生成痛点,在个维度优化创新,还带来商业应用新可能。

机器之心
算法论文8

NUS LV Lab新作|FeRA:基于「频域能量」动态路由,打破扩散模型微调的静态瓶颈

在大模型时代,参数高效微调(PEFT)已成为迁移大规模扩散模型至下游任务的标准范式。但现有微调方法采用「静态」策略,忽略扩散生成过程内在规律。新加坡国立大学LV Lab等机构提出FeRA框架,通过频域能量动态路由,实现高效微调。

机器之心
推荐文章8

当顶级视频模型半衰期只有 30 天,fal.ai 为什么收入反而一年增长 60 倍?

生成式媒体技术发展背景下,fal.ai 作为生成式媒体 infra 公司迅速崛起。它通过统一 API 与云端平台提供模态模型调用能力,2025 年收入增长 60 倍并完成融资。文章解析其如何构建护城河及对行业发展的判断。

海外独角兽