「安全缺陷」共找到 1086 篇相关文章
「世界理解」维度看AI视频生成:Veo3和Sora2水平如何?新基准来了
近年来,T2V模型进展显著,Sora2爆火引发对其是否为‘世界模型’的探讨。传统基准无法系统衡量模型对事件因果等的理解,中山大学等团队提出新评测框架VideoVerse,评测主流模型并发现开源与闭源模型差距及各模型缺陷。
Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃
大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。
C3仓库AI代码门禁通用实践:基于Qwen3-Coder+RAG的代码评审
本文介绍C3仓库基于Qwen3 - Coder+RAG的代码评审实践,在CI流水线监听代码修改触发AI评审,可发现逻辑风险、拦截高危缺陷。该实践能提升评审效率与质量,可复用于代码门禁平台或辅助编程工具,当前仍在持续优化。
“不爱龙虾爱马仕”,为什么Hermes比OpenClaw更值得
文章对比了Hermes Agent和OpenClaw,Hermes由Nous Research出品,开源免费,安装便捷,支持多模型。其核心是闭环学习循环,能自我进化,技能可自动生成和更新,记忆系统更优,在多场景有优势,安全设计好。
Hinton最新警告:杀手机器人或将带来更多战争,最大担忧是AI接管人类
近日,「AI教父」Geoffrey Hinton在采访中预警,「杀手机器人」等致命自主武器让战争更易发动,降低了战争成本、改变了战争方式。他更担忧人类被AI接管,还指出AI公司在安全方面做得不够,同时也提到了AI在医疗等领域的应用。
聊聊钉钉的悟空:给一个还没人走路的市场卖跑鞋?
钉钉发布悟空,与其他大厂先面向个人用户不同,它走企业级路线,有四层Skill体系等,虽初期被认为‘太重’,但钉钉全产品CLI化等创新有潜力,且安全设计是企业刚需,适合特定人群关注。
微软AI新天团曝光!只有1位华人,「谷歌系」超1/3
微软AI CEO苏莱曼领导的17名核心高管阵容曝光,新增9名核心成员中有5位来自谷歌(包含DeepMind)系,8名老将中有2名来自苏莱曼共同创办的Inflection AI。新核心团队将聚焦AI产品落地、安全与隐私、增长与商业化。
全民拜龙?我看是大厂“套壳大战”搞疯了
OpenClaw是开源AI Agent框架,引发全民热潮,中国大厂纷纷推出套壳产品。国产套壳产品上手难度低,但也存在问题。傅盛基于此养出AI团队,猎豹移动市值涨24%。不过,OpenClaw存在安全问题,背后是Token入口争夺战。
一夜之间,核心决策权旁落:年入195亿的公司,未来走向何方?
近日,荷兰政府接管安世半导体,称其有治理缺陷。三名外籍高管联手让闻泰科技董事长张学政被暂停安世半导体职务。闻泰科技回应是过度干预,已启动法律与外交途径,安世在多领域有布局。
Claude 通过率不到 4%,SaaS-Bench 撕碎了 Computer-Use 的「全自动办公」幻想
UniPat AI用SaaS - Bench测试,让Agent在真实工作环境中执行任务。结果显示,Claude Opus 4.7端到端完全通过分数仅3.8%,多数模型表现差,还暴露Agent四种致命缺陷,揭示其与真实工作能力有巨大鸿沟。