架构图生成」共找到 3959 篇相关文章

算法论文8

ICCV2025 | One image is all you need,多模态指令数据合成,你只管给,剩下的交给Oasis

近年来多模态指令数据合成依赖人工设计提示词,成本高。本文提出 Oasis 方法,仅靠生成数据,打破传统输入模式,还开源代码库 MM - INF。实验显示其数据多样,能提升 MLLM 性能。

机器之心
推荐文章7

给企业应用注入AI:架构师需关注的3大工程挑战与9种设计模式

文章指出企业常将AI引入现有应用,集成时要考虑系统风险。介绍架构师需关注的3大工程挑战及9种设计模式,含可用性、性能、安全增强相关模式,助企业让AI应用从“能用”变“好用”。

AI大模型应用实践
算法论文8

UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述

多伦多大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理像、视频等异常检测任务进展,提供分类体系,展望未来趋势。

机器之心
算法论文8

中山大学梁小丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁小丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。

AI科技评论
新闻资讯7

从 AI 3D生成转型AI原生影视公司,Utopai Studios想「稍微」改造下好莱坞

2022年创立的AI 3D生成公司Cybever转型为Utopai Studios,获好莱坞人士投资,还推出两部AI影片计划。其00后掌舵者Cecilia Shen称要变革制作范式,解决AI视频模型瓶颈,解放创作者。

Founder Park
算法论文8

单GPU搞定高清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta

普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟级生成高质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。

量子位
新闻资讯7

为什么你的 Agent 总是出故障?从算力基建到可信熔断的架构生死线 | 直播预告

本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 的构建之道。将探讨大模型基础设施、可信 Agent 架构、MCP 协议实战等内容,还会解答观众提问。

InfoQ
开源动态8

Transformer开始构建三维世界:开源模型几张片秒级生成可探索3D场景

影溯将最新研究成果做成免费3D捕捉工具Crystal空间相机,背后技术QuerySplat已开源。其模型Topos - Lite改变组织三维空间方式,少量片就能秒级生成3D场景,还能扩展容量。影溯团队经验丰富,技术应用场景广。

机器之心
新闻资讯7

GPT 4o-mini华人领队离开OpenAI:真正推动AI进步不是模型架构,而是互联网

前OpenAI研究员Kevin Lu加入Thinking Machines Lab,该公司2025年7月获约20亿美元早期融资,估值约120亿美元。Kevin Lu曾主导GPT - 4o mini发布,他认为真正推动AI进步的是互联网,而非模型架构

新智元
算法论文8

长文本生成迎来新突破:拓元智慧推出 DrDiff ,实现效率与质量双提升

拓元智慧联合多团队开发出 DrDiff 框架,解决长文本生成中效率与质量难兼顾问题。其核心是“动态化”,有分层稀疏注意力、动态专家调度、语义锚点状态三个创新组件,经测试表现良好,未来应用值得期待。

AI科技评论