检测方法评测」共找到 2246 篇相关文章

算法论文8

具身智能威胁分析的分层方法和全景图

文章指出具身人工智能应用广泛,安全需求迫切,但现有研究鲜少涉及具身化场景。复旦大学等组织分析400多篇论文,提出具身智能威胁分析全景,介绍各层攻击方法、危害及防护措施。

AI与安全
新闻资讯8

2025 智能体元年,Agent 开发平台深度评测报告解读

2025 年 AI 产业两大核心趋势并行,AI Agent 产业化落地提速。国家工业信息安全发展研究中心赛昇实验室发布评测报告,对阿里云百炼等四大 Agent 开发平台从 RAG、工作流能力、Agent 工具调用三大维度测试,为行业选型提供参考。

特工宇宙
算法论文8

多模态大模型持续学习系列研究,综述+Benchmark+方法+Codebase一网打尽!

近年来,生成式AI和多模态大模型进展显著,但在动态环境下实现持续学习是挑战。中科院自动化所联合香港院AI中心系统性研究,提出综述、方法、Benchmark和Codebase,为相关人员提供全面支持。

机器之心
开源动态8

世界模型评测的最大盲区,被这个新基准捅破了

过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出新基准MemoBench,测试了主流模型,揭示其短板。

机器之心
算法论文8

揭秘 | 桥梁缺陷检测新突破:模型压缩42%,精度几乎不掉

全国公路桥梁超百万座,传统人工巡检效率低且有安全风险,现有深度学习检测模型体积大、计算量高。研究团队提出LBSD - YOLO网络,通过创新实现轻量化,实验显示模型瘦身但性能不减,有重要应用价值。

机器学习AI算法工程
算法论文8

CVPR 2026 | 20步也能稳住画质,这个扩散加速方法不一样

扩散模型推理效率是落地应用的核心制约因素,阿里安全 AGI 实验室 - 御风大模型团队联合浙江大学提出全新扩散加速方法 TC - Padé,在低步数设置下能兼顾生成质量与推理效率,已被 CVPR 2026 录用。

机器之心
开源动态7

OpenAI开源Privacy Filter:PII检测不用传服务器 Apache2.0可商用

OpenAI开源Privacy Filter模型,采用Apache2.0协议可免费商用。它是PII检测工具,支持全本地运行,避免数据泄露。有诸多技术亮点,也有一定局限性,上线后下载量可观。

AI工程化
开源动态8

清华发布世界模型评测新标尺:直击机器人感知与行动鸿沟

清华大学等机构推出 WorldArena 评测基准,用于测试 EWM 真实能力。它融合感知与功能评估,含十六项视频指标,结合主客观评价生成 EWMScore。测试揭示模型在感知与行动上的差距,转型为实用型模型是行业挑战。

AIGC开放社区
推荐文章8

吴恩达推出LLM 后训练免费课程,覆盖三大调优方法:SFT、DPO、RL

吴恩达发布「Post-training of LLMs」课程,由Banghua Zhu主讲,瞄准实用技术,重点介绍SFT、DPO、RL三种后训练方法,有大量动手实验,课程发布后引发热烈讨论。

AGI Hunt
算法论文8

首个GUI多模态大模型智能体可信评测框架+基准:MLA-Trust

MLA-Trust 是首个针对 GUI 环境下多模态大模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。

机器之心