「3D动作捕捉」共找到 2278 篇相关文章
CVPR 2026 三维视觉趋势梳理:从 RGB 感知,到真实世界建模
计算机视觉行业从追求识别能力转向关注视觉系统对真实世界的理解。CVPR 2026研究中,多视角、事件视觉、开放集3D生成和相机运动轨迹被引入视觉理解,多篇论文从不同侧面推动视觉系统走向对真实世界的理解。
从零开始,教你用Codex搓出属于你自己的第一个硬件。
作者分享用Codex开发久坐提醒猫爪硬件的过程。先与Codex聊需求、写代码,再按其提供的清单买硬件,连线、烧录也靠它指导,还可让它调试动作、操控3D打印,体现AI时代硬件开发的便捷。
Yann LeCun离开Meta后首篇论文?使用了宇树机器人做研究
伯克利、纽约大学等团队发表论文,提出GenMimic方法,让机器人能零样本复现AI生成视频动作。Yann LeCun是共同导师之一。团队构建GenMimicBench数据集,经仿真和真实实验验证方法可行。
斯坦福临床医疗AI横评,DeepSeek把谷歌OpenAI都秒了
斯坦福最新大模型医疗任务评测,构建含35个基准测试的MedHELM综合评估框架。结果显示,DeepSeek R1以66%胜率领先,o3 - mini等模型也各有表现,还分析了成本效益。
GPT-6 Astra 发布了,我却把 GPT 的订阅从 100 刀降到 20
9 月 1 日作者将 Codex 订阅从 100 美元降至 20 美元,两天后 OpenAI 发布 GPT - 6 Astra。作者降级是因大量用 K3、Qwen 3.8 和 GLM5.3 等。Astra 功能强大,但作者仍会让国产模型担主力。
首家AIOS落地来自vivo:个人化智能复刻人类思维,手机还能这样用
2025年vivo开发者大会展示全新端侧AI能力,提出蓝心3B端侧多模态推理大模型,融入OS底层,实现系统级智能。其AI OS打造“个人化智能”体验,还开放生态,携手开发者推动AI应用落地。
Python 2还能走多远?
自2020年Python 2停止维护,虽仍有项目在用,但企业和社区都在向Python 3迈进。文章介绍了Python 2的发展历程、存在的问题,阐述Python 3的优势,并给出了从Python 2切换到Python 3的方法。
字节推出全新视频换装框架DreamVVT
视频虚拟试穿技术受关注,但现有方法有局限。字节推出DreamVVT框架,基于扩散变换器,分两阶段试穿,能应对多种复杂场景,不过也存在依赖遮罩、复杂动作表现不稳定等问题。
腾讯发布Hunyuan-GameCraft!从静图进入动态游戏世界
近年来,现有方法难满足游戏视频生成需求。腾讯推出Hunyuan - GameCraft,可基于一张图像和提示词生成游戏交互视频,能精准响应交互信号,保留历史场景信息,不过动作空间待丰富。
Hinton最新预言刷屏:谷歌必赢,而且「早该赢了」!
Google凭借Gemini 3、自研芯片、强大数据与研究团队,正在重新超越OpenAI。辛顿认为谷歌会赢,且早该赢了。Gemini 3 Pro在多方面表现出色,而ChatGPT增速放缓,OpenAI面临挑战。