「AI安全审计」共找到 10056 篇相关文章
14K Star!统御万模的 AI 聚合网关,一个 API 管理所有大模型!
文章分享了AI聚合网关神器New API,它基于Go和React开发,是中转分发系统,像超级转换插头。集成30+模型服务,有多种特性,支持6种部署方式,能收敛混乱的模型调用。
首个基因推理AI 横空出世!准确率飙至97%,彻底改变基因组学研究
多伦多大学等团队发布全球首个基因推理AI模型BioReason,将DNA基础模型与大语言模型融合,准确率从88%提至97%,可解释基因组变异致病机制,有望上线Hugging Face,应用前景广。
用了半年的MCP,它不是“USB-C”,而是企业AI落地的噩梦!
文章指出MCP虽曾被视为AI界USB - C接口,但企业落地时问题诸多,如类型安全靠猜、标准协议名存实亡、调试困难等,还给出企业级MCP落地自查清单。
Agentic Deep Research新范式,推理能力再突破,可信度增加,蚂蚁安全团队出品
尽管LLM能力提升,但在复杂任务上受静态内部知识限制。业界提出Agentic Deep Research系统,不过现存系统有梯度冲突和奖励稀疏问题。蚂蚁安全团队提出Atom - Searcher,解决上述问题,实验效果良好。
实测刘翔pick的AI汽车,BBA老车主的豪华滤镜碎了
作者试驾了刘翔代言的智己汽车LS8,体验其智能辅助驾驶、AI助理等功能。该车与宝马X5等尺寸相近但价格低,有诸多黑科技,还让BBA老车主滤镜破碎,显示传统豪华溢价时代或终结。
7个AI玩狼人杀,GPT-5获断崖式MVP,Kimi手段激进
OpenAI总裁转发基准测试,让7个LLMs玩210场狼人杀。GPT - 5胜率96.7%断崖式领先,国产Qwen3和Kimi - K2分列第4、6。测试方分析模型性格,还借此研究LLMs社会行为,长远目标是实现AI驱动的市场研究。
ICML 2026|让AI自动发现前沿风险:创智×复旦×牛津发布AutoControl-Arena
当AI智能体走向真实应用,前沿风险藏于复杂长尾场景,难以靠人工覆盖。创智、复旦、牛津联合发布AutoControl Arena框架,自动合成可执行测试环境,还构建X - BENCH验证,已在GitHub开源。
杀死“流水线”: ColaOS(ListenHub)如何构建 AI 时代的液态超级团队 | QCon
4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。ColaOS联合创始人徐文健将分享《杀死“流水线”》,复盘ListenHub“任务酒馆”模式,揭示让组织具“液态”创新能力的逻辑。
你的电脑已被手机接管!Anthropic亮出Dispatch:AI 24小时给你代工
3月17日,Anthropic发布Cowork新功能Dispatch,可让用户用手机远程指挥Mac上的Claude操作电脑完成任务。设置简单,目前仅对Max订阅用户开放,实测成功率约50%,其本地运行设计保障安全。
拆解AI短剧流水线:4道技术关卡,和一个反直觉的赚钱真相
文章拆解AI短剧流水线,介绍其要解决的核心问题,用框架分析四道收敛闸门,提及主流工具组合,还算了成本账,指出产能涨但公司巨亏,赚钱关键从制作转向投流。