文本到 3D 生成」共找到 4229 篇相关文章

算法论文8

LLM时代的事件抽取:从静态任务认知脚手架

此综述论文探讨LLM时代事件抽取价值,认为其未被削弱,应视为“认知脚手架”。它系统梳理任务分类、方法演进等,还提出六大未来研究方向,指向将其演化为智能感知与记忆层。

深度学习自然语言处理
算法论文8

合成数据≠生成模型:一文读懂合成数据的全新范式

最新研究提出合成数据全新分类框架,突破‘生成模型=合成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出合成数据面临模型坍塌等挑战,正成新型基础设施。

新智元
推荐文章8

用子模优化做文本选择、段落重排和上下文工程

文章围绕子模优化展开,介绍其在文本选择、段落重排和上下文工程中的应用。指出当前重排器的缺陷,通过子模优化可解决冗余问题。还给出实验结果,凸显其优势,如理论保证、自动停止机制等。

Jina AI
开源动态7

一句话生成可上线的动效,这个项目真不错!

Github上的`Text-to-lottie`是开源Skill框架,可让Claude Code或Codex当动效设计师,按Lottie规范生成标准`lottie.json`。它有Coding Agent直出Lottie JSON、内置预览播放器等特色,助开发者快速产出合规Lottie资产。

开源先锋
产品应用7

让YOLO飞起来:从CPUGPU的配置指南

文章指出默认安装的YOLO用CPU计算,处理大量图像或实时检测任务效率低。详细介绍将YOLO从CPU模式切换GPU模式的步骤,对比性能,还给出常见问题解决办法,能显著提升运行效率。

机器学习AI算法工程
产品应用7

本地可运行的高质量的文本转语音模型

介绍Kyutai的Pocket TTS,一款轻量级文本转语音应用,可在CPU高效运行,模型小且低延迟,支持Python API和CLI,能语音克隆,还可在浏览器试用,目前仅支持英语,也有社区浏览器端实现。

GitHubStore
新闻资讯7

太疯狂了!Meta裁员裁田渊栋头上,连组员一锅端

Meta AI大裁员裁田渊栋头上,还整组裁。田渊栋在Meta工作超十年,是FAIR研究科学家总监,开发过“Dark Forest”等。他成果多,OpenAI等已在抢人,此次裁员或不简单。

量子位
推荐文章7

从金融本位物理本位,真正的范式转移开始了

过去几十年,人们认为增长可由货币政策调控,但如今瓶颈转移。马斯克描述的闭环体现从“金融本位”“物理本位”的范式转移,科技巨头已按此逻辑行动,锁定物理资源。

newtype AI
开源动态8

智谱联合清华开源多图参考视频生成模型,带来主体一致性新高度

合肥工业大学、清华大学和智谱开源多主体参考视频生成模型Kaleido。它用全新数据构建法和精巧架构,解决主角与背景混淆难题,实验显示其在多维度表现优异,超越现有开源模型。

AIGC开放社区
推荐文章7

AI 会生成 PPT 之后,Runtime 决定了它能做多好

作者回顾PPT Agent发展,指出存在Agent理解操作文档及AI生成PPT表达单一的问题。提出Artifact Runtime概念,它让PPT可被持续操作,还能接管重复决策,但不能替代专业判断。

phodal