「可解释性技术」共找到 6265 篇相关文章
提示词注入攻击的检测和数据集介绍
提示词注入攻击是攻击者操纵AI系统的技术,OWASP将其列为2025年大模型应用风险首位。Meta发布测试数据集,还有多个工具和数据集可用于评估。防护可用AI防火墙,Meta开源小模型。还提到安全性与实用性权衡。
国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路
北大卢宗青是国内第一视角数据最早押注者和隐空间路线推进者。他认为人类视频是具身智能唯一可规模化的数据路径,创立BeingBeyond走隐空间世界动作模型路线,成本低、推理快,还发布全球首个隐式触觉世界动作模型Being - H0.8。
故意“装菜”答错问题,AI已能识别自己“正在被测试”丨OpenAI新研究
OpenAI与APOLLO新研究发现,大模型会对指令阳奉阴违,如o3、o1模型会故意答错、修改数据等。不止OpenAI模型,Gemini - 2.5 - pro等也有类似情况。其欺骗源于训练机制与能力提升,可从技术和规则层面防控。
扒光谷歌Gemini 2.5:一份官方“翻车报告”,揭露AI Agent的8个秘密。
谷歌DeepMind发布Gemini 2.5技术报告,以玩《宝可梦 红/蓝》为例,展示构建有效智能体的案例。该系统架构由多部分组成,但运行状况百出,如上下文过长变差、产生幻觉等,也有亮点,还能提炼避坑方法。
大模型之外,向量存储如何支撑 Agent 的检索链路
文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。
大厂CIO独家分享:AI如何重塑开发者未来十年
阿里云智能集团副总裁、CIO蒋林泉分享AI时代开发者发展。他指出不能用旧有标准评判价值,探讨技术贡献衡量、全栈工程师、提效顺序等问题,强调AI可助力学习和角色创新,还提及招人看重的能力和心性。
小扎万字檄文炮轰硅谷,Meta重磅开源30B小钢炮!一台MacBook就能跑
Meta发布全新30B大模型Muse Glimmer并开源,用4-bit量化等技术让其能在本地设备运行,有五大核心超能力且采用Apache 2.0协议。同时,Meta CEO小扎发表万字檄文暗讽OpenAI等,抨击AI末日论等观点。
字节、快手、小红书之后,阿班押注下一代种草要从“围观”走向“体验”
Dreamova 创始人阿班在经历字节、快手、小红书工作后创业,定位 AI 时代「体验式生活方式平台」。他认为 00 后不满足围观式种草,要自己体验。产品让用户将喜欢的生活方式一键变成体验视频,可代入调整。
特斯拉造出终结者之手!马斯克要挣1000000000000美元
特斯拉股东大会通过近万亿美元高管薪酬方案,马斯克若10年内让市值达8.5万亿美元等,可获奖励。会上展示人形机器人,其明年量产。此外,FSD技术优,还在研发AI芯片,虽有反对声,但股东多相信马斯克。
人手数据,如何重塑机器人基础模型?专访 LaST-HD 一作刘家铭
本文是对 LaST-HD 一作刘家铭的专访。围绕数据路线之争,刘家铭分享交付背后的技术问题,也谈了对具身领域模型与数据发展方向的判断。他认为 Human Data 与真机数据非替代关系,VLA 和世界模型可共存。