生成式设计」共找到 3594 篇相关文章

产品应用8

解密谷歌 NotebookLM 技术幕后【上】:知识如何被“转译”为 AI 对话播客

NotebookLM是Google推出的AI知识工具,能将文档、网页等内容转化成笔记、播客、视频等。文章探秘其技术,解析AI音频播客与视频生成能力,还给出构建音频播客生成器的实践流程。

AI大模型应用实践
开源动态8

4.8K Star!一套面向设计工程师的 AI 编码智能体 UI 技能集合!

前端开发中AI生成代码质量参差不齐,ui - skills项目应运而生。它由开发者ibelick创建,是面向设计工程师的UI技能集合,将开发经验转化为规则,通过CLI工具让AI按规则构建和审查代码,已获4.8k Stars。

开源星探
推荐文章7

给企业应用注入AI:架构师需关注的3大工程挑战与9种设计

文章指出企业常将AI引入现有应用,集成时要考虑系统风险。介绍架构师需关注的3大工程挑战及9种设计,含可用性、性能、安全增强相关模,助企业让AI应用从“能用”变“好用”。

AI大模型应用实践
算法论文8

UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述

多伦多大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理图像、视频等异常检测任务进展,提供分类体系,展望未来趋势。

机器之心
算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。

AI科技评论
新闻资讯7

从 AI 3D生成转型AI原生影视公司,Utopai Studios想「稍微」改造下好莱坞

2022年创立的AI 3D生成公司Cybever转型为Utopai Studios,获好莱坞人士投资,还推出两部AI影片计划。其00后掌舵者Cecilia Shen称要变革制作范,解决AI视频模型瓶颈,解放创作者。

Founder Park
算法论文8

单GPU搞定高清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta

普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟级生成高质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。

量子位
开源动态8

Transformer开始构建三维世界:开源模型几张图片秒级生成可探索3D场景

影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方,少量图片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。

机器之心
开源动态8

沉浸翻译杀疯了!双重开源:左手像素级还原PDF排版,右手本地AI隐私保护!

沉浸翻译是跨平台在线翻译工具,有网页、文档等翻译功能,获千万用户与Chrome年度殊荣。近期开源BabelDoc和OneAIFW,前者还原PDF排版,后者保护本地隐私,解决阅读和安全问题。

开源星探
算法论文8

长文本生成迎来新突破:拓元智慧推出 DrDiff ,实现效率与质量双提升

拓元智慧联合多团队开发出 DrDiff 框架,解决长文本生成中效率与质量难兼顾问题。其核心是“动态化”,有分层稀疏注意力、动态专家调度、语义锚点状态三个创新组件,经测试表现良好,未来应用值得期待。

AI科技评论