Doka相机」共找到 35 篇相关文章

算法论文8

ECCV'26 | 为视频虚拟试衣解锁自由视角,TryOnCrafter玩转4D试衣代理

现有视频虚拟试衣方法受限于固定相机视角,难以满足用户自由观察需求。本文提出 TryOnCrafter 框架,定义可控相机视频虚拟试衣任务,引入可渲染 4D 试衣代理,支持多种下游应用,为虚拟试衣开辟新路径。

机器之心
产品应用8

谷歌重磅发布Flow,人人都能制作好莱坞级电影

谷歌在‘I/O 2025’大会发布影视级AI制作工具Flow,它是Video FX迭代版,由Veo 3、Imagen和Gemini支持。具备专业影视制作功能,已有知名制作人用其产出高质量作品,已开放使用。

AIGC开放社区
新闻资讯7

GoPro卖身了,准备搞光模块

当地时间9月1日,GoPro与Starman Optical达成合并协议,后者2.85亿美元收购约90%股权。GoPro曾辉煌,后因产品、对手、内存等问题衰败。Starman看中专利等,GoPro或涉足新领域。

DeepTech深科技
产品应用7

连马桶都会看图说话了,巨头敢卖,你敢坐么?

老牌卫浴巨头科勒发布马桶相机Dekoda,599美元,拍照识别屎尿分析健康,还能区分用户。此外,Throne等公司也有相关产品。这些产品定位健康管理,不过面临信任、算法准确性等挑战。

机器之心
算法论文8

好看不等于会交互!阿里发布基于交互的世界模型基准

阿里等联合推出 Omni - WorldBench 评估框架,指出多数高颜值 AI 视频在物理规律和交互逻辑上有缺陷。该框架含提示词套件和量化评估框架,对 18 款模型测评,为 4D 世界模型研发指明方向。

AIGC开放社区
算法论文8

视频「缺陷」变安全优势:蚂蚁数科新突破,主动式视频验证系统RollingEvidence

蚂蚁数科AIoT团队论文提出主动式可信视频取证系统RollingEvidence,利用相机卷帘门效应嵌入物理水印,结合AI与概率模型验证,抵御伪造篡改,在检测准确率和防护能力上优于传统技术。

机器之心
算法论文8

VGGT4D:无需训练,挖掘3D基础模型潜力,实现4D动态场景重建

香港科技大学(广州)与地平线研究团队提出 VGGT4D,无需训练,通过挖掘 Visual Geometry Transformer 注意力层运动线索,在动态物体分割等任务表现优异,为 4D 重建提供新思路。

机器之心
算法论文8

Light-X来了!全球首个「镜头×光照」双控4D视频生成框架,单目视频秒变电影级

新加坡南洋理工大学等科研机构联合推出Light - X,全球首个「镜头×光照」双控4D视频生成框架。它解耦相机与光照,在扩散模型中融合,还构建Light - Syn数据管线,实验显示其效果显著优于现有方法。

机器之心
开源动态8

机器人看不清,蚂蚁给治好了

天下苦机器人看不清透明和反光物体久矣,问题出在深度相机。蚂蚁集团具身智能公司蚂蚁灵波开源深度视觉模型LingBot - Depth,无需换硬件,用创新算法和大量数据提升性能,还将开源数据集。

量子位
产品应用7

The Batch: 969 | 谷歌的机器人模型有了腿

谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。

DeeplearningAI