多尺度生成」共找到 5668 篇相关文章

算法论文8

ERNIE 5.0:走向原生统一的万亿参数模态基础模型

过去模态模型‘拼接式’方案存在理解与生成割裂问题,ERNIE 5.0 借此提出,用统一自回归框架做模态理解与生成,在架构、训练与系统层面有创新,评测中各模态能力表现出色。

深度学习自然语言处理
算法论文8

模态推理新范式!DiffThinker:用扩散模型「画」出推理和答案

上海人工智能实验室等团队提出全新生成模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在项复杂任务中表现优于顶尖闭源模型,有四大核心特性。

机器之心
新闻资讯8

第四届智能流体力学产业联合体大会在深圳隆重召开

2025年11月29日,第四届智能流体力学产业联合体大会在深圳召开。众专家学者参会,交流前沿问题与成果。会上发布“智能体协同流体力学工业软件平台”“风神NF3”数字孪生风洞等,还围绕议题研讨。

力学与人工智能
算法论文8

NeurIPS 2025 Spotlight | 你刷到的视频是真的么?用物理规律拆穿Sora谎言

随着生成式AI发展,合成视频以假乱真,现有检测方法难泛化。本文介绍发表于NeurIPS 2025的文章,提出NSG统计量和NSG - VD检测方法,对未知生成范式检测效果好,实验表现超越现有方法。

机器之心
新闻资讯7

2025年哪款模型最受欢迎?Poe最新报告:DeepSeek降温、可灵成黑马

AI工具聚合平台Poe发布2025年1 - 5月人工智能模型使用趋势报告。显示模型市场份额消长明显,推理模型势头正劲,图像、视频、音频生成领域各有竞争态势,如DeepSeek降温,可灵成视频生成黑马。

Founder Park
算法论文8

NTU S-Lab 团队探索可动 3D 新方向:结构、关节、纹理一次到位

南洋理工大学 S-Lab 团队发布研究,提出统一建模框架,能从单张图像生成可动三维对象,在几何精度、外观一致性与运动合理性上显著提升,解决了现有方法的难题,为相关领域发展奠定基础。

AI科技评论
算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在基准测试表现出色。

机器之心
新闻资讯8

今天起,GPT Image 2要把全体设计师送走了

GPT Image 2横空出世,暴打Nano Banana 2,其超强文字渲染和设计能力颠覆众行业。它生成的图片真假难辨,解决文字渲染难题,降低数字内容生成成本,让设计师面临失业危机,也使互联网信任体系洗牌。

新智元
推荐文章7

Anthropic实践发现:Multi-Agent系统的核心仍然是Prompt设计!

近期Anthropic分享构建智能体研究系统最佳实践,提出8条研究智能体的提示工程与评估原则。其架构采用协调者 - 工作者模式,与传统RAG方法不同,使用步骤搜索动态查找信息。

PaperAgent
产品应用8

嚯!国产视频模型的物理水准超神了 | 实测MiniMax海螺02

MiniMax上新视频生成模型Hailuo 02,解决了AI视频生成中体操难题。该模型原生支持1080p,能处理极端复杂物理场景,实测文生、图生视频能力出色,成本创新低,MiniMax本周还有项技术布局。

量子位