文本到 3D 生成」共找到 4229 篇相关文章

算法论文8

从「能用」「好用」:数据可视化的三个维度,你还在第一层吗?——人大提出图表创作新方式

数据可视化面临静态视觉与动态叙事挑战,如设计繁琐、动画门槛高、交互难复用。中国人民大学IDEAS Lab团队与山东大学交叉研究中心推出PiCCL、CAST、Libra,解决创作难题,还探索用大模型提升可视化效率。

量子位
算法论文8

清华联手英伟达打造扩散模型新蒸馏范式!视频生成提速50倍,4步出片不穿模

清华大学朱军教授团队与NVIDIA Deep Imagination研究组联合提出分数正则化连续时间一致性模型(rCM),将连续时间一致性蒸馏扩展至大模型,解决现有方法瓶颈,提升推理速度兼顾质量与多样性。

量子位
开源动态7

别再傻傻做视频啦!!!52.1k Star Remotion,把 React 组件变成视频生产线,强离谱~~

Remotion是用React程序化创建视频的开源项目,可把视频元素写成组件按时间线组合后渲染。它适合有批量生产需求者,不过做真人vlog等传统剪辑软件更顺手,且使用有license限制。

小华同学ai
算法论文8

AI写CUDA算子准确率92%,国产芯片只剩4%?上交方法直线拉升,DeepSeek也适用

GPT-5.2写CUDA算子正确率92%,给华为Ascend NPU写算子仅4%,因公开数据少等致‘新硬件冷启动’难。上海交大团队EvoKernel不训新模型、不标新数据,将GPT-5.2正确率从4%拉83%,还拓展DeepSeek架构算子。

机器之心
推荐文章7

泛娱乐 AI 赛道观察: 从「猜你喜欢」参与共创,角色才是 AI 时代最核心的资产

文章围绕AI泛娱乐产品展开,指出AI时代产品观应从二元对立转为三元共生。AI可实现个性化体验,从“猜你喜欢”“与你共创”。还分析了不同体验心态及案例,强调角色是核心资产,未来产品可降低门槛、扩圈发展。

Founder Park
算法论文8

腾讯发布SpecExit算法,无损压缩端端加速2.5倍!解决大模型长思考效率难题

腾讯发布 SpecExit 算法,将思考早停与投机采样融合,利用轻量级草稿模型预测“退出信号”,在不引入额外探测开销的前提下,实现动态、可靠的思考早停,在 vLLM 上推理端端加速 2.5 倍,准确性和推理效率得双重保障。

机器之心
新闻资讯8

奥特曼首次体验GPT-5!被吓眩晕瘫坐,那一刻就像看原子弹爆炸

新智元报道,奥特曼曝光GPT - 5使用初体验,称被震撼瘫坐。他宣称或为每人提供免费全天候GPT - 5,还提出诸多设想,如分配token、对孩子教育看法等,也谈AI对社会的影响及竞争态度。

新智元
开源动态8

一年从3B卷0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一

文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移多任务表现良好。

量子位
新闻资讯8

CES 2026超前瞻:空间智能来势汹汹!从实验室奢侈品消费级刚需,如何重塑 AI 具身时代?

2026年CES展上,空间智能从学术概念迈向产业实践。当前具身智能存在‘语言强、手脚笨’困境,空间智能是破解关键。全球分世界生成与空间决策两条技术路径,且行业正迎来成本降低的拐点。

机器之心
开源动态8

“甲方快乐模型”诞生,拿下平面设计新SOTA!多条件一键生成,还能独立调整元素 | 复旦&字节

复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、多模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在多维度评估基准上表现出色,还支持多轮编辑。

量子位