智能体安全评估」共找到 4639 篇相关文章

算法论文8

Google研究发现:Multi-Agent的核心竟然是Prompt设计!

Google和剑桥大学研究多智能体系统,发现提示设计影响大,有效拓扑结构占比小。提出Mass框架分三阶段优化,实验用Gemini 1.5 Pro和Flash模型,对比多种方法,在多任务上性能显著提升。

PaperAgent
算法论文8

AGI失控率>90%!MIT教授算出「康普顿常数」,AI地球「夺权率」已锁定?

MIT教授研究指出,即使采用理想监督机制,人类成功控制超级智能概率仅52%,全面失控风险超90%。研究通过量化分析提出嵌套可扩展监督等理念,并在四个真实监管场景验证,探讨如何优化现实监管系统。

新智元
新闻资讯7

DoorDash 如何打造了一款不完全依赖大型语言模型(LLM)的 AI 购物助手

DoorDash 分享对话式 AI 助手 Ask DoorDash 的架构,它借助 LLM、AI 代理等构建系统。测试显示其提升了结账转化率等指标,还构建自动评估框架改进质量衡量,架构分离协调与业务功能。

InfoQ
产品应用8

「动嘴办公」火起来了!TRAE SOLO让打工人张嘴就能干活

新智元报道,TRAE SOLO与Insta360联名推套装,实现「动嘴办公」。它能智能转录、修正语义、直调功能,可处理代码、文件等。还能过滤口语、理解语义,降噪拾音。4月底将上线实时问答互动。

新智元
新闻资讯8

库里被「采访」、杨紫被「演」短剧?别慌!蚂蚁AI鉴真拿下CVPR 2026冠军,专治黑产

深度伪造技术滥用,明星成换脸受害者,引发社会关注。蚂蚁集团AI安全实验室队伍MICV获CVPR 2026挑战赛冠军,还发布检测资源仓库。团队提出基于DINOv3的框架,解决AIGC检测难题,成果显著。

机器之心
新闻资讯7

Anthropic宣布练出神话级模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!

Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。

AI寒武纪
新闻资讯8

阿里成立Token Hub事业群,打碎钉钉,做成龙虾!

阿里巴巴成立Alibaba Token Hub事业群,首席执行官吴泳铭挂帅。旗下设5大事业部,目标是创造、输送和应用Token。还发布企业级旗舰应用悟空,重写底层架构,打造专属文件系统与Skill生态,展示多款智能硬件。

AIGC开放社区
算法论文8

ICLR 2026|多模态大模型真的理解情绪吗?MME-Emotion给出了系统答案

多模态大模型迅速发展,但能否理解人类情绪存疑,且缺乏系统性评测框架。香港中文大学和阿里通义实验室团队提出 MME - Emotion 评测基准,评测 20 个主流模型,发现模型情感智能不足,为后续研究提供参考。

机器之心
推荐文章7

AI时代,最老的设计哲学反而最有效

50年前的Unix哲学‘万物皆文件’和‘文件夹即应用’正以意想不到的方式回归。过去因‘人类可理解性’被推崇,如今因AI能操作而重获重要性,文件夹成‘智能空间’,AI成其操作系统。

newtype AI
新闻资讯7

Meta 大裁员,华人科学家田渊栋受波及

据 Axios 报道,Meta 本周二从超级智能团队裁撤约 600 岗位,涉及多部门,TBD 实验室不受影响。华人科学家田渊栋等受波及,此次裁员或因研究官僚化,团队重组是为 AGI 愿景铺路。

AI科技评论