算法论文8
清华团队:相机自运动让空间音频标注零成本
量子位
AI 摘要
清华和密西根大学团队:以往空间音频技术难规模化,新方案用互联网视频和相机自运动,无需标注和特制设备,模型就能学三维空间听觉,可用于多领域。
阅读原文 · 量子位
千万级标注成本归零!CVPR 2025清华团队成果:相机的“自运动”就是最好的老师
以往空间音频模型受限于采集条件和标注成本,清华和密西根大学团队在CVPR 2025给出新路径,利用相机自运动作监督信号,让模型从互联网视频学三维空间音频感知,成果入选会议Highlight。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
清华团队22年让机器人学会踢足球
今年8月,清华赵明国教授团队联合字节跳动Seed等在《Science Robotics》发表论文,提出视觉驱动的反应式足球技能学习框架。该研究历经22年技术接力,成果在真机和赛事中验证,加速进化平台助力研究。
机器之心
新闻资讯8
清华团队:让天眸芯成AI视觉新选择
清华大学类脑计算研究中心团队成果三年两登Nature封面。晰见科技承接天眸芯技术产业化,重新做AI的眼睛。天眸芯拆解视觉信息,构建互补通路,团队还研究算法融合信息,目前芯片进展良好。
DeepTech深科技
算法论文8
北航等提出红外主导目标检测方案InfraNet
在复杂视觉场景中,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。
新智元
算法论文8
清华团队:裸眼3D视角扩至150°
清华大学戴琼海、吴嘉敏团队在 Nature Photonics 发表研究,提出“超斯涅尔扫描光场显示(SSS - LiD)”方案,在 150°超宽视角下实现高分辨率裸眼 3D 显示,还分析了裸眼 3D 技术的商业化前景。
DeepTech深科技