无监督异常检测」共找到 374 篇相关文章

算法论文8

腾讯提出Vision-SR1:让模型真正学会“看图思考”,而不是“蒙答案”

视觉语言模型(VLMs)存在视觉幻觉和语言捷径问题,限制其可靠性和泛化能力。腾讯提出Vision - SR1训练方法,通过推理分解和自我奖励机制,不依赖外部监督,提升模型视觉感知和推理可靠性。

深度学习自然语言处理
开源动态8

3D指标超过Nano Banana Pro!浙大开源方案让AI在平面图像里进行立体编辑 | ACM MM'26

当前图像编辑模型处理三维状态常出错。浙江大学ReLER团队提出并开源PhyEdit,用显式3D几何preview指导图像编辑,还加入深度监督,构建数据集和评测基准,成绩超Nano Banana Pro,且GUI也开源。

量子位
算法论文8

SceneSplat: 基于3DGS的场景理解和视觉语言预训练,让3D高斯「听懂人话」的一跃

文章引入 SceneSplat,首个在 3DGS 上原生运行的端到端大规模 3D 室内场景理解方法,提出自监督学习方案,构建发布 SceneSplat - 7K 数据集,在多个实验中达 SOTA 效果。

机器之心
新闻资讯7

00后高盛金融男,欲奸杀前女友,被ChatGPT上报后被捕

25岁前高盛分析师Darren Zhou在ChatGPT写下强奸谋杀前女友计划,OpenAI检测到威胁后举报给FBI。Zhou 8月认罪,被判8年缓刑。此前OpenAI曾因未报警致枪击惨案,AI平台报案界限待明确。

新智元
新闻资讯8

英伟达:RLP 让 AI 在预训练时就学会思考

英伟达研究团队发布 RLP 技术,与传统大语言模型训练不同,它在预训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了大模型训练范式。

AI工程化
新闻资讯7

21 页 PDF 实锤 Grok 3“套壳”Claude?Grok 3 玩自曝,xAI工程师被喷无能!

网友 GpsTracker 爆料,xAI 公司的 Grok 3 在“思考模式”下自称是 Anthropic 公司的 Claude 3.5。多种模式测试显示异常回应仅在“思考模式”触发,21 页 PDF 记录也证实其“自曝”。此事引发热议,有人吐槽预训练团队水平差。

AI前线
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉大模型DINOv3,采用自我监督学习,无需标注数据。它在60多个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应多种部署环境。

AIGC开放社区
新闻资讯7

豆包手机底层系统被曝是锤子 SmartisanOS!官方深夜回应微信登录异常

近日,豆包手机助手发售被抢购一空。随后有博主发现其底层系统疑似锤子 SmartisanOS。此外,该助手还出现微信登录异常、被指侵犯隐私等问题,官方深夜回应称是技术预览版,面向特定人群,会保障隐私。

InfoQ
推荐文章7

规范驱动开发:让架构变得可执行

文章介绍规范驱动开发(SDD),它是软件架构重大转变,以可执行规范为核心,构建五层执行模型,反转传统架构关系,强调漂移检测,明确人机分工,具备五项核心能力,但采用时也面临多种权衡。

InfoQ
算法论文8

AI胡说八道这事,终于有人管了?

AI大模型幻觉问题棘手,GPT - 5幻觉率降低。苏黎世联邦理工学院和MATS研究提出低成本、可扩展检测法,精准识别实体级幻觉,分类器超现有基准,还能识别逻辑错误,团队已公开数据集。

机器之心