静态人物图」共找到 408 篇相关文章

产品应用8

拿下3D生成行业新标杆!昆仑万维Matrix-3D新模型鲨疯了,一张建模游戏场景

昆仑万维推出3D世界生成框架Matrix - 3D,能从单像生成高质量、轨迹一致的全景视频并还原可漫游3D空间。它优势明显,还突破多项技术难题,背后是昆仑万维对空间智能的战略布局。

量子位
算法论文8

一张生成「能动」的3D资产:VAST+香港大学AniGen把AIGC推向动画、游戏、仿真与具身智能 (SIGGRAPH 2026 TOG)

SIGGRAPH 2026论文AniGen,由VAST和香港大学研究,能从单张片直接生成带骨架与蒙皮权重的可动画3D资产。它解决了现有方法的不足,在多方面表现出色,对多个领域意义重大。

机器之心
算法论文8

AI在实时视频里秒“剪”出你想要的部分!输入文字//视频片段,它都能秒懂|ICCV2025

最新混合模态在线视频定位技术OVG - HQ开挂了!它能根据文字、、视频片段等线索,在实时视频流中精准裁剪出关心的事件,已收录于ICCV2025,破局以往技术“离线”“词穷”缺陷。

量子位
产品应用7

互联网黑话之西游记版 AI 视频的制作方法

文章介绍互联网黑话之西游记版AI视频制作方法。先与AI共创剧本,以互联网黑话结合西游记场景为佳;再让AI根据剧本和人物形象生成包含多内容的分镜脚本,生成首帧后按脚本制作视频,不满意可反复生成再拼接。

宝玉AI
算法论文8

Graph工程的尽头是,Ontology工程

15家机构联合发布工程系统性综述,指出此前“XX工程”范式多优化单个智能体,而工程能将智能提升到系统层面。论文还指出工程语义局限,认为本体工程可作下一代系统智能语义地基。

PaperAgent
开源动态8

NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的像编辑模型!

继谷歌Banana后,英伟达开源物理级像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律像,适用于多领域。

开源星探
算法论文7

Agentic-KGR:通过多智能体强化学习实现知识谱的协同演化

文章指出静态知识库有覆盖缺失、时效滞后、建用分离问题。介绍 Agentic - KGR 创新点,如动态 schema 扩展等。实验显示其在谱抽取和下游 QA 任务有提升,还呈现训练动态和谱质量可视化结果。

PaperAgent
算法论文8

AlphaGo作者领衔,8个机械臂协同干活0碰撞,DeepMind新作登Science子刊

DeepMind等机构成果RoboBallet登Science子刊。它将神经网络用于强化学习,可控制8个机械臂协同无碰撞工作。核心是结合神经网络与强化学习,解决多机器人协作复杂问题,实验表现出色。

量子位
推荐文章7

AI们数不清六根手指,这事没那么简单。

作者测试发现Grok4、OpenAI o3等多模态模型都将六指数成五指,仅Claude 4偶尔答对。研究揭示大模型看片用记忆而非视觉,易受刻板印象影响,在工业等场景或引发严重后果。

数字生命卡兹克
产品应用7

Nano Banana 邪修之王最强科研成果!教你自定义生比例!

Nano Banana 出有分辨率低和比例不可控问题。作者发现用垫方式可控制其生比例,已生成片也适用,还给出操作方法、提示词,介绍不同平台效果及案例下载方式。

歸藏的AI工具箱