文章生成流程」共找到 4041 篇相关文章

产品应用7

给 AI 一张陶罐碎片图,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐图,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题。

AI科技评论
推荐文章8

手把手带你构建第一个业务本体(Ontology):为 Agent 绘制业务地图。

文章介绍为企业AI Agent构建业务本体,阐述Agent需本体的原因,讲解TBox与ABox概念。给出构建流程,介绍RDF/OWL标准及Protégé等工具,实战构建‘订单加急交付’本体并验证,还演示Python程序推理,展望本体应用场景。

AI大模型应用实践
推荐文章7

AI 编码 3.0:人机协作,正在走向多 Agent 协作系统化

文章指出AI编码正从2.0走向3.0,2.0解决生成问题,3.0则是执行系统。当Agent进入软件交付流程,协作需从经验驱动转向模型驱动,Kanban和Harness等工具也有了新角色,系统更强调验证和控制。

phodal
算法论文8

无需NeRF/高斯点后处理,视频秒变游戏模型成现实!新方法平均每帧仅需60秒 | ICCV 2025

KAUST团队提出全新方法V2M4,能从单目视频直接生成高质量、显式的4D网格动画资源。该方法构建多阶段流程,涵盖相机轨迹恢复等关键步骤,平均每帧约60秒,比现有方法显著提速,论文已被ICCV 2025接收。

量子位
算法论文8

百万规模数据集打造人形机器人通用大模型,实现精细动作跨平台、跨形态动作迁移丨北大人大联合发布

北大和人大团队在通用人形机器人动作生成领域取得重大突破,首创通用动作生成框架Being - M0,构建百万规模动作生成数据集MotionLib,研发文本驱动动作生成模型,实现人体动作向多类型人形机器人迁移,文章将发表于ICML2025。

量子位
产品应用8

揭秘!腾讯如何训练多智能体像专家一样设计游戏场景

腾讯游戏提出游戏场景自动布局生成系统IntelliScene 2.0,利用图像引导生成3D场景。它构建多智能体工作流,结合高质量数据集,经模型微调、视觉解析等步骤生成场景,经评估效果良好,为AI生成三维信息提供新路径。

腾讯技术工程
算法论文8

设计师大解放!清华发布「建筑平面图」自动生成模型 | ACL'25

清华大学吕帅团队提出FloorPlan-LLaMa模型,采用自回归生成架构与RLHF机制,解决传统平面图自动生成模型‘指标优秀但实际不可用’痛点,提升生成式平面图设计质量与实用价值。该论文被ACL录用获领域主席奖。

新智元
开源动态8

终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。

量子位
推荐文章7

Claude:转述

作者李继刚每日阅读包含书、经典文章和最新文章。最新文章信息量大,让人消化不良。为此需要一个Prompt,输入文章链接或文本,输出转述精华,还给出了转化原理、方向等内容。

李继刚
开源动态8

清华系DeepSeek时刻来了,硅谷沸腾!单卡200倍加速,视频进入秒级时代

清华大学TSAIL实验室与生数科技开源视频生成加速框架TurboDiffusion,引发全球AI社区热议。它能在几乎不影响生成质量的前提下,让视频生成速度飙升100 - 200倍,将AI视频带入实时生成时代。

新智元