信息图生成」共找到 2936 篇相关文章

产品应用8

太逼真!豆包·播客模型来了:一句话生成「苏超联赛」播客,很懂13太保的梗

火山引擎发布豆包·播客模型,生成的AI对话语气、停顿等像真人。操作简单,生成快且有字幕。能处理多种类型内容,如热搜话题、苏超联赛、超长文本等。其基于端到端实时语音模型,有技术突破。

量子位
算法论文8

智源清华带来PAM,手物交互数据生成新SOTA | CVPR 2026

北京大学、清华等联合提出统一引擎PAM,能整合姿态、外观和运动。用户提供初始和目标姿态及物体几何形状,它就能生成逼真手物交互视频。其效果超现有方法,合成视频可用于数据增强。

AI科技评论
开源动态8

标准化3D生成质量榜单来了!首创层次化评价体系,告别“谁的demo更吸睛”主观评估

Hi3DEval团队推出面向3D内容生成的全新层次化自动评测体系Hi3DEval,设计对象级、部件级与材质主题三层评测协议,在HuggingFace发布首期3D生成榜单,涵盖30个主流与前沿模型。

量子位
产品应用8

业界首个高质量原生3D组件生成模型来了!来自腾讯混元团队

腾讯混元3D团队推出业界首个高质量原生3D组件生成模型Hunyuan3D - Part。现有3D生成算法有局限,该模型提出新范式,含P3 - SAM和X - Part,在多数据集评估中超越现有工作,还给出体验地址和论文地址。

量子位
开源动态8

一张生成任意场景3D模型,部分遮挡也不怕|IDEA x 光影焕像联合开源

IDEA研究院张磊团队与香港科技大学谭平团队联合推出SceneMaker框架,以DINO - X与Triverse为基础,实现从任意开放世界像到带Mesh的3D场景完整重建,解决遮挡难题,有多项创新,应用场景广泛。

量子位
推荐文章8

GPT-4o生成的「核燃料」找到了!万字长文拆解潜在变量,网友:原来AI在另一个维度作画

上月,GPT - 4o生成功能爆火。Sander Dielman在博客中探讨生成模型利用潜在空间提高效率和质量,将潜在变量比作「数据精髓」,深入对比多种模型,还介绍训练方法、损失函数等,兼具理论深度与直观洞察。

机器之心
推荐文章7

最新豆包、deepseek、元宝、夸克、千问、百度、文心、Kimi、微信搜一搜、抖音、小红书等AI搜索生成内容引用来自哪些地方?【干货】

作者白杨SEO指出,生成式人工智能发展快,AI搜索优化GEO受关注。介绍了豆包、DeepSeek等多个AI搜索生成内容引用来源,如豆包引用抖音、头条等,DeepSeek用开源数据等,还提及各平台优化要点。

白杨SEO优化教程
新闻资讯8

深扒ICLR「泄露门」:AI学术历史上最魔幻的61分钟,或许没有之一

2025年11月27日,ICLR 2026发生严重安全事故,超1万篇论文评审信息泄露。攻击者利用OpenReview API漏洞获取信息,引发轩然大波。此外,Pangram Labs报告显示21%审稿意见为AI生成,暴露出学术评审诸多问题。

新智元
产品应用8

AI视频生成走向“演技生成”时代,生数科技Vidu全球发布Vidu Q2 | 甲子光年

9月25日,生数科技全球上线新一代生视频大模型Vidu Q2,实现从“视频生成”到“演技生成”跨越。它在表情生成、运镜、语义理解、时长选择等方面有提升,分闪电和大片模式,已在多端上线。

甲子光年
新闻资讯7

Nano Banana核心团队:生成质量几乎到顶了,下一步是让模型读懂用户的intention

这是对Nano Banana核心团队的专访。团队认为生成质量提升空间有限,未来关键在模型可表达性和读懂用户意。还探讨了像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。

Founder Park