三维场景生成」共找到 3831 篇相关文章

开源动态8

不用千亿参数也能合成高质量数据!这个开源框架让小模型“组团逆袭”,7B性能直追72B

上海人工智能实验室与中国人民大学提出GRA框架,以“多人协作”理念让小模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对大模型蒸馏依赖,展现“集体智能”潜力。

量子位
产品应用8

刚刚,中国AI交卷!40年难题56分钟破局,AI不再「学习」

文章介绍AI科研应用新趋势,从学习已知知识转向搜索未知解。以百度‘伐谋’为例,它助力南京林业大学检测松材线虫病,还在多学科和产业场景中展现价值,百度还启动科学家计划推动其发展。

新智元
算法论文8

ERNIE 5.0:走向原生统一的万亿参数多模态基础模型

过去多模态模型‘拼接式’方案存在理解与生成割裂问题,ERNIE 5.0 借此提出,用统一自回归框架做多模态理解与生成,在架构、训练与系统层面有创新,评测中各模态能力表现出色。

深度学习自然语言处理
算法论文8

多模态推理新范式!DiffThinker:用扩散模型「画」出推理和答案

上海人工智能实验室等团队提出全新生成式多模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在多项复杂任务中表现优于顶尖闭源模型,有四大核心特性。

机器之心
算法论文8

NeurIPS 2025 Spotlight | 你刷到的视频是真的么?用物理规律拆穿Sora谎言

随着生成式AI发展,合成视频以假乱真,现有检测方法难泛化。本文介绍发表于NeurIPS 2025的文章,提出NSG统计量和NSG - VD检测方法,对未知生成范式检测效果好,实验表现超越现有方法。

机器之心
推荐文章7

人生周报v044:费曼

文章围绕AI应用展开,指出人机交互是AI应用竞争壁垒,介绍典型案例及交互形态,分析Agent不同场景,还提及AI应用创业要素,最后推荐《费曼经典:一个好奇者的探险人生》。

李继刚
新闻资讯7

2025年哪款模型最受欢迎?Poe最新报告:DeepSeek降温、可灵成黑马

AI工具聚合平台Poe发布2025年1 - 5月人工智能模型使用趋势报告。显示模型市场份额消长明显,推理模型势头正劲,图像、视频、音频生成领域各有竞争态势,如DeepSeek降温,可灵成视频生成黑马。

Founder Park
新闻资讯8

今天起,GPT Image 2要把全体设计师送走了

GPT Image 2横空出世,暴打Nano Banana 2,其超强文字渲染和设计能力颠覆众多行业。它生成的图片真假难辨,解决文字渲染难题,降低数字内容生成成本,让设计师面临失业危机,也使互联网信任体系洗牌。

新智元
算法论文8

ICLR-26腾讯混元:Agent是强大的,但用户是狂野的

现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,对58个模型评估,发现模型准确率低,揭示LLM在真实场景下能力缺口,为模型优化指明方向。

PaperAgent
产品应用7

破局之刃已然出鞘!国产处理器选哪家?

本文精选2025年参评“芯师爷-硬核芯年度评选活动”的国产处理器产品,介绍了海光、紫光同创等企业的处理器特点及应用场景,指出国产处理器在性能逼近国际主流,未来胜负手是生态协同与场景渗透。

芯师爷