「扩散生成技术」共找到 4715 篇相关文章
除了prompting外,不动参数,如何改变模型行为?
文章指出传统提示工程控制大模型生成行为有缺陷,提出Steering Target Atoms (STA)方法。它用稀疏自编码器分解LLM高维表示,定位“原子知识组件”精准控行为,实验效果超现有技术,还能控制推理长度。
ICCV 2025 | 小红书AIGC团队提出图像和视频换脸新算法DynamicFace
小红书AIGC团队提出图像和视频换脸新算法DynamicFace。该算法创新性融合扩散模型与3D人脸先验,解耦身份与运动信息,设计双流注入架构和时序一致性模块,实验证明其在身份保真与运动还原上优势明显。
AI 播客原理解析
作者分享用豆包AI播客将英文长文转成高质量播客的体验,解析AI把文章变真人对话式语音播客的原理,涉及提示词工程和文字转语音技术,还介绍提示词写作与优化过程及长文处理方法。
实测Perplexity Pro平替模型,免费开源仅4B
一款仅4B大小的开源模型Jan-v1,声称能平替Perplexity Pro,且完全免费、支持本地部署。实测发现,它在检索增强生成、上下文深度分析等能力上表现不错,入门级显卡即可带动本地部署。
飞猪搭建系统演进:从人工运营到多Agent协同搭投生产
飞猪移动端页面搭建体系从初代寄生于阿里集团平台,发展成“搭投”体系。但传统人工选搭投模式待优化,为此启动AI智能搭投升级专项,构建新范式,还介绍产品结构、技术实现及后续规划。
机器人WAIC现场抢活讲PPT?商汤悟能具身智能平台让机器人「觉醒」
具身智能火爆但面临数据瓶颈等难题。商汤在WAIC推出具身智能平台「悟能」,以世界模型为引擎,有感知、导航、交互等功能,其开悟世界模型能生成多视角视频,为机器人提供数据支持。
清华联手快手可灵,撞车谢赛宁团队RAE,用SVG再证明VAE已过时
AI图像生成正告别VAE技术。清华与快手可灵联合提出SVG方案绕开VAE,纽约大学谢赛宁团队也提出RAE模型。SVG用自监督特征构建潜空间,在质量、效率和通用性上超传统,证明统一视觉模型可行。
00后以1.1亿美金「掀桌」,硅谷AI将书写影视新传奇 终结制片旧时代
00后Cecilia Shen创立的Cybever转型为AI原生影视工作室Utopai Studios,首年获1.1亿美元收入。其技术经四个阶段进步,能生成高质量3D虚拟环境,还带来两部大剧,有望改变影视行业格局。
大模型微调评测入门:看懂这些指标,才知道模型好不好
文章指出大模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。
CES 2026超前瞻:空间智能来势汹汹!从实验室奢侈品到消费级刚需,如何重塑 AI 具身时代?
2026年CES展上,空间智能从学术概念迈向产业实践。当前具身智能存在‘语言强、手脚笨’困境,空间智能是破解关键。全球分世界生成与空间决策两条技术路径,且行业正迎来成本降低的拐点。