物理攻击」共找到 611 篇相关文章

算法论文8

AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

2026年4月28日,Anthropic联合剑桥大学发布论文,提出“内省适配器”技术,可让大模型用自然语言“坦白”微调中学到的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。

AI科技评论
推荐文章7

具身智能最“脏”的活,被三个老炮干成了亿元生意|甲子光年

具身智能行业数据是关键卡点,海量数据中能用于训练具身模型的数据稀缺。智域基石提出“数据编译”理念,搭建包含五个环节的管线。该公司已获数千万元天使轮融资,成立4个月订单近亿元,从工业场景切入,规划了三阶段发展路径。

甲子光年
新闻资讯8

高盛怕了!Claude Mythos全球首个攻破企业网络,奥本海默时刻来了

英国AI安全研究所研究显示,Anthropic发布的Claude Mythos Preview模型在网络安全评估中表现惊人,能全自动、全自主完成企业网络攻击模拟。高盛为此加强网络防御,人类网络安全或进入奥本海默时刻。

新智元
产品应用8

MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳

腾讯混元团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。

量子位
算法论文8

CVPR2026 | 鬼手想点谁就点谁?LaSM让GUI智能体把注意力「收回来」

文章聚焦弹窗式环境注入攻击,指出多模态智能体易受环境干扰致目标漂移。提出 LaSM 方法,通过放缩关键层权重让智能体注意力回到任务,实验显示其提升防御效果,且对正常任务影响小。

机器之心
开源动态7

OpenClaw不会蛋炒饭!Ropedia放出人类经验,机器人「教科书」来了

当LeCun和李飞飞各自拿下10亿美元押注世界模型时,一个更底层的问题浮出水面:谁来为Physical AI提供真正能用的数据?Ropedia给出的答案,不是更多视频,而是一部结构化的、来自真实世界的「经验百科全书」。

新智元
开源动态8

机器人看不清,蚂蚁给治好了

天下苦机器人看不清透明和反光物体久矣,问题出在深度相机。蚂蚁集团具身智能公司蚂蚁灵波开源深度视觉模型LingBot - Depth,无需换硬件,用创新算法和大量数据提升性能,还将开源数据集。

量子位
新闻资讯7

快手遇P0级安全事故,市值蒸发近百亿;字节120名员工因触犯红线被辞退;Karpathy自曝“作为程序员从未感到如此落后”,引爆焦虑|AI周报

本周AI界热点不断,Karpathy推文引科技圈焦虑;快手遇安全事故市值蒸发近百亿;京东员工年终奖优厚;字节辞退120名违规员工;还有英伟达重组云团队、微软纳德拉抓AI产品等消息。

AI前线
7

DeepMind招募波士顿动力前CTO,哈萨比斯点赞宇树

据Wired报道,谷歌DeepMind聘请波士顿动力前CTO Aaron Saunders,他将解决物理世界实现AGI的硬件问题。这是谷歌机器人战略的人才回流,Hassabis想让Gemini成机器人操作系统,他看好宇树但更关注软件。

机器之心
新闻资讯7

B站整了个搞笑诺贝尔评选,也太难绷了

B站2025超级科学晚变身搞笑诺贝尔奖颁奖典礼,获奖研究脑洞大开,如狼人杀AI、给蚊子变性等。虽看似不正经,实则是各领域正经科研突破,涉及数学、物理、医学等多领域。

量子位