文本到 3D 生成」共找到 4229 篇相关文章

算法论文8

启发学习:让大模型认知从外化内生

当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。

机器之心
推荐文章7

从 GPT Agent,技术与业务如何“双向奔赴”

InfoQ《极客有约》X AICon 直播栏目邀请徐文健、李陈忠、张昊阳探讨大模型产品落地路径。他们分享从 GPT Agent 的经历、认知转变,讨论通用 Agent 及创业机会,还谈及 AI 产品难点和人才标准变化。

InfoQ
算法论文8

如何将LLM的"思考习惯"迁移视觉领域?

传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。

深度学习自然语言处理
推荐文章8

AI-Native 的 Infra 演化路线:L0 L5

文章来自 Agent Infra 创业者 Hang Huang,以其产品开发实践经验,分享 Agent Infra 机会。指出 AI 编程生产力跃迁,从写代码掌控软件全生命周期是趋势,还提出 L0 - L5 模型描述 AI-Native Infra 演化路径。

海外独角兽
新闻资讯7

32G内存条从800元暴涨3800元之后

央视财经报道内存涨价潮席卷全球,从上游芯片制造下游终端产品均受影响。AI爆发致存储芯片供需失衡,上游厂商利润狂欢,中游方案商转型,下游终端产品成本上升、格局分化,产业进入价值重构新周期。

芯师爷
产品应用7

多稿合并:从手动比稿一键 Skill

AI 翻译或写作常生成多版本稿件,各有亮点但不完美。手动合并耗力,可让 AI 完成。还能将流程做成 Claude 的 Skill,介绍了两种创建方式及适用场景,给出多稿合并 Skill 示例。

宝玉AI
产品应用8

实测 MiniMax H3:开源“斩杀线”蔓延视频模型圈

本文实测 MiniMax H3 视频模型,它 8 月 3 日开源,成本低至 0.5 元/秒,在编辑榜成绩佳。它定位全模态生成,能多素材输入。实测效果好,价格约为 Seedance 2.5 的三分之一,还支持原生剪辑,适配多芯片与工具。

特工宇宙
算法论文7

SceneWeaver:面向通用三维环境生成的反思型智能体框架

室内场景合成在具身智能兴起下愈发重要,现有方法存在局限。BIGAI提出SceneWeaver框架,通过基于工具的迭代优化统一多样场景合成范式,具有高保真模拟、强健物理交互等优势。

带你学AI
新闻资讯8

对话VAST曹炎培:2秒才是3D生成本该有的速度

本文对话VAST首席科学家曹炎培,介绍其最新Smart Mesh功能,仅靠提示词或参考图,2秒内极速生成3D模型。Tripo P1.0重构AI 3D底层范式,实现原生三维空间概率生成。VAST获5000万美元A轮融资,今年将推UGC 3D平台。

量子位
新闻资讯7

Gartner:2029年,50%的云计算将用于AI工作负载

全球著名咨询调查机构Gartner公布未来4年影响云计算增长的几大趋势,如对云不满、AI/机器学习需求增加等,还给出各趋势的预测情况及应对建议。

AIGC开放社区