「AI安全评估」共找到 10422 篇相关文章

产品应用8

一手实测 Amazon Quick:我看到了企业级 Agent 的未来!

本文针对企业AI工具碎片化、员工沦为Agent间搬运工的痛点,对刚GA发布的亚马逊云科技Amazon Quick做一手实测,分析其核心能力与壁垒,判断企业级Agent发展趋势。

特工宇宙
推荐文章8

Lilian Weng:Harness才是模型自我迭代的现实起点和关键,而不是直接重写权重

Thinking Machines Lab联合创始人Lilian Weng发文指出,实现AI递归式自我改进(RSI),设计围绕模型的执行系统“Harness”才是现实起点。文中详述Harness设计模式、优化路径,也指出自我改进面临的瓶颈。

AI寒武纪
新闻资讯7

OpenAI谷歌Anthropic罕见联手发研究!Ilya/Hinton/Bengio带头支持,共推CoT监测方案

OpenAI、谷歌DeepMind、Anthropic联合发表立场文件,提出CoT监测概念,认为是控制AI Agent核心方法。探讨其潜在机遇、局限,还提及不同公司对CoT监测的不同态度,如OpenAI乐观,Anthropic焦虑。

量子位
新闻资讯8

“千问奶茶”在二手平台6元转售;追觅俞浩:年终奖最高20个月奖金,总量会达到10亿级;京东001号快递员:退休金4000多,存款百万|AI周报

这是一份AI周报,涵盖行业热点、大模型发布等多方面信息。有追觅俞浩高额年终奖计划,马云现身阿里千问项目组引发‘千问奶茶’活动热潮,还有域名交易、企业收购、模型发布及应用等动态。

AI前线
开源动态8

Github 8.7K star 厉害!!! 一款轻量好用的web自动化项目!

Nanobrowser是开源Chrome扩展工具,专注AI驱动的网页自动化。免费且本地运行,保护隐私,支持多主流大模型。有多智能体协同等特点,还介绍了安装配置方法,是高效安全的网页自动化之选。

开源先锋
产品应用7

我想给 OpenClaw 接上语音,结果有人先做了

作者一直想用语音对接 OpenClaw,却发现「光帆AI」团队已朝此方向发展。他们用 APP 跑通「耳机 + 服务」链路,后续将迁移到硬件。作者体验后觉得交互爽,还介绍了接入方法、安全模式等。

AGI Hunt
开源动态8

Wassette:微软基于 Rust 构建的 Wasm 与 MCP 之间的桥梁

微软 Azure Core Upstream 团队发布 Wassette,它基于 Rust,搭建起 WebAssembly 组件与 MCP 间的桥梁,让 AI 智能体可自主获取和执行工具,还保障了安全,且未来有更多发展规划。

InfoQ
算法论文8

Anthropic重磅研究:250份文档就能 “搞垮” 大模型?

Anthropic等团队发布研究,进行大规模投毒攻击模拟。结论是投毒大模型所需‘毒药’数量与模型大小和干净数据量无关,取决于投毒文档绝对数量,250份就能‘搞垮’模型,改变了对AI安全的认知。

AIGC开放社区
新闻资讯7

The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出

OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。

DeeplearningAI
新闻资讯7

“干了20年,没见过这阵仗”:一句话说明存储行情有多火

当前存储行情火爆成‘超级风暴’,产业链各方看法不一。AI算力驱动需求,致产能被挤占,行业从‘周期性短缺’到‘结构性缺货’,市场规则改变,上下游悲喜不同,终端厂商也面临诸多挑战。

芯师爷