算法论文8
复旦腾讯新算法入选CVPR 2025
量子位
AI 摘要
复旦大学、腾讯优图等团队:设计新模型DualAnoDiff用于工业异常检测,采用双分支并行生成机制和背景补偿模块,实验显示其生成数据质量高、多样,能提升下游检测任务性能。
阅读原文 · 量子位
用大模型检测工业品异常,复旦腾讯优图新算法入选CVPR 2025
AI模型用于工业异常检测获新SOTA,相关论文中稿CVPR 2025。复旦大学、腾讯优图实验室等机构研究人员设计基于扩散模型的少样本异常图像生成新模型DualAnoDiff,实验显示其性能更优。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
复旦&引望WAM-Diff2让自动驾驶解码提速15.1倍
视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。
机器之心
算法论文8
字节团队发现文生图Scaling新变量
ByteDance Seed团队研究发现,文生图模型中自然语言Caption变长,不意味着模型获更多视觉监督,其信息量更能预测训练损失。团队提出Structured Prompt,从两侧提升文本条件,在多任务上取得显著提升。
机器之心
开源动态8
新智具身联合复旦补齐具身智能“手感”
新智具身联合复旦大学发布三份技术报告,将触觉跃升为具身智能核心基建。构建3万小时交互语料库统一触觉“方言”;提出新方案让机器人提前预判触觉;在世界模型中重构“触觉想象”,推动具身智能“视触融合”。
机器之心
算法论文8
清华团队:相机自运动让空间音频标注零成本
以往空间音频模型受限于采集条件和标注成本,清华和密西根大学团队在CVPR 2025给出新路径,利用相机自运动作监督信号,让模型从互联网视频学三维空间音频感知,成果入选会议Highlight。
量子位