视频动捕」共找到 1105 篇相关文章

开源动态8

不止起来:SentiAvatar重新定义3D数字人作生成范式

AI 初创公司 SentiPulse 联合团队提出 3D 数字人作生成新范式 SentiAvatar,打造虚拟角色 SUSU,其框架等已全球同步开源。它解决了高质量数据荒等问题,实验表现优,还实现快速作生成,支持流式交互。

机器之心
算法论文8

TGRS 2025 | FSConv:空域结构+频域提细节,即插即用的特征增强神器

红外小目标检测存在目标小、背景干扰大难题,传统卷积易丢失特征信息。TGRS 2025论文提出FSConv模块,通过双域融合提升特征表达能力,具备多尺度特征保持、轻量化、自适应增强等优势,有广泛应用场景。

机器学习AI算法工程
开源动态7

OpenMAIC:一键生成互课堂,视频+PPT全都有,还可以编辑

清华开源项目OpenMAIC是多智能体互课堂,上传文档或描述主题,几分钟就能生成虚拟课堂,AI教授讲课、同学讨论,还有白板功能。底层用LangGraph编排,支持主流模型,有OpenClaw集成,架构完整。

AI工程化
开源动态8

RSS 2025 软硬件全开源,智源清华带来混灵巧脸Morpheus

清华大学赵昊团队联合多家机构发布高拟真机器人面部系统Morpheus,融合三项关键技术,能实时生成多种细腻表情。它在核心指标表现出色,有三大创新突破传统瓶颈,为下一代情感机器人奠定技术基座。

AI科技评论
产品应用7

FairyGen:AI 把孩子的画“”起来,个性化教育和画创作

FairyGen 能将孩子画作变成卡通短片,通过多模态大语言模型构思分镜脚本,采用分层建模处理前景人物作与背景态。其生成流程分四阶段,但也存在前景角色重建不准、背景生成不稳定等问题。

带你学AI
产品应用8

嘴写SQL!Codex+终身记忆,OpenAI把查询难度直接归零

2026年初,OpenAI曝光数据分析智能体,将数据查询从「天数级」缩至「分钟级」。它用Codex驱,有六层上下文架构,能补齐数据语义、沉淀经验记忆,让工程师提问取代手查表。

新智元
产品应用7

ChatGPT这次对数学教育了真格,家长学生都不用愁了

OpenAI针对数学和科学学科抽象难学问题,推出ChatGPT态可视化交互解释新功能,从超70个核心概念起步,可让用户拖变量、调整公式,实时观察结果变化,今日面向全球已登录用户开放。

AI寒武纪
产品应用8

小鹏加速冲向L4终局:对VLA架构「刀」成关键一环

在辅助驾驶领域,端到端的VLA方法虽有效果,但面临中间层语言难以准确表达物理世界细节的问题。小鹏汽车去掉“语言转译”环节,推出第二代VLA,有跨代级驾驶体验,背后是底层技术架构重构。

机器之心
算法论文8

李飞飞又被超越了?百万「普通视频」打造通用4D世界模型!

全行业为昂贵多视角数据发愁时,中科院和CreateAI推出NeoVerse,用百万单目视频打开4D世界模型大门。它抛弃多视角数据和离线预处理,解决扩展性瓶颈,在重建速度、生成质量等方面表现出色,有丰富下游应用。

新智元
算法论文8

视频刷多了AI也会变蠢!“年度最令人不安的论文”

最新研究显示,大模型灌多垃圾内容会‘脑损伤’,研究人员用不同维度定义垃圾数据并训练模型,测试其核心能力,发现垃圾数据致认知下降,且损伤不可逆,还给出行业启发。

量子位