安全防御」共找到 925 篇相关文章

算法论文8

LoRA中到底有多少参数冗余?新研究:砍掉95%都能保持高性能

这篇创新研究介绍了LoRI技术,证明即使大幅减少LoRA的可训练参数,模型性能依然强劲。研究团队在多个任务上测试了LoRI,发现仅训练LoRA参数的5%,LoRI就能匹配或超越其他方法的性能。

机器之心
产品应用8

Claude 5.1双旗舰突然发布:跑分屠榜,反蒸馏,科研能力大幅跃升,缓存费用暴降75%

Anthropic发布Claude Fable 5.1和Claude Mythos 5.1两款大模型,性能登顶且解决开发者关注问题。缓存读取费用降75%,跑分屠榜,科研能力强,安全系统重构,合作实测效果好,盲测风格与GPT - 5.6 Sol不同。

AI寒武纪
产品应用7

The Batch: 969 | 谷歌的机器人模型有了腿

谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。

DeeplearningAI
产品应用8

Claude Opus 5 发布,比 Fable 5 强,仅一半价格

Claude Opus 5发布,官方称其以一半价格提供接近Fable 5的智能。跑分显示它多数项目超Fable 5,ARC - AGI - 3成绩突出,还更省token,是Anthropic迄今对齐度最高的模型。

AGI Hunt
开源动态8

英伟达开源深度研究引擎:企业级数据不出门,研究自动做

NVIDIA推出AI-Q Blueprint,将深度研究流水线打包成Agent Skill,解决企业级数据处理难题。它能让企业数据不出门,代理框架可派任务并获报告,还支持多种认证模式,代码库可本地部署,专为深度研究打磨。

AIGC开放社区
产品应用7

Codex龙虾化!推出手机远程控制,与Claude Code竞争白热化

OpenAI的Codex可手机远程控制,与Claude Code竞争白热化。它跨设备无缝同步,支撑体验的是安全中继层技术。个人开发者体验提升,企业级环境诉求也得到回应,还推出针对性扩展工具。

AIGC开放社区
算法论文7

700多个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI自曝黑料

Anthropic故意训练近700个「有问题」模型,训了LoRA适配器(IA)让模型自报家门。IA在AuditBench平均成功率59%,但也存在幻觉、成本高、训练分布无指南等局限。

新智元
新闻资讯8

Anthropic史诗级泄密!全新模型意外曝光:能力碾压Opus 4.6,因太危险被限制发布

Anthropic重大泄密,全新模型“克劳德神话”(Claude Mythos)及Capybara层级曝光。新模型性能超Claude Opus 4.6,但因网络安全隐患大未全面发布,首批仅给安全机构。泄密源于配置失误。

AI寒武纪
产品应用7

两个95后华人,搞出硬件版Clawdbot,售价1700元

本文介绍硬件版OpenClaw——Distiller Alpha,其核心计算基于树莓派CM5,集成多设备,能和Agent对话,可Vibe coding。量子位采访创始人叶天奇,探讨软硬一体Agent、OpenClaw优缺点、硬件创业等问题。

量子位
新闻资讯8

硅谷AI战火烧进医院!终于可以告别「天书」化验单了

OpenAI和Anthropic的战火燃至医疗领域,OpenAI发布ChatGPT健康,Anthropic推出医疗健康版Claude,还打通数据壁垒,提供个性化健康解答。其还在提升模型能力,保障隐私安全,且各有应用场景。

新智元