「智能体安全评估」共找到 4624 篇相关文章
从 Shopify 构建 Agent 的经验中可以学到的
Shopify 分享构建 Agent 经验,采用主流 Agentic Loop 架构。给出4条打造 AI 智能体核心建议,还指出工具控制在20个内,可用 SubAgent 分摊上下文;用人类标记结果作基准让 LLM 评估 Agent 生成结果。
华为乾崑 all in 启境,开启造车新模式
在华为乾崑生态大会上,启境给出了自己的答案。华为不仅技术赋能启境,还将团队、流程与之深度融合。启境目标是打造不妥协产品,成为‘六边形战士’,其愿景是塑造‘移动智能体’。
模型不是企业的护城河,那什么才是?
文章指出企业AI进入深水区后,真正的竞争是将AI变成企业自己的智能引擎。衔远科技创始人周伯文提出泛化基础上的深度专业化是企业竞争力来源。衔远发布EnterpriseClawBench,揭示企业需私有化评估和可持续进化能力。
文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”
港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。
奥特曼:温和奇点已降临!AI最终掌控物理世界,2030年人类命运大转折
奥特曼在「温和的奇点」一文中称人类跨越AI发展「事件视界」,进入指数级加速阶段。他预测了未来5年技术时间线,还指出奇点悄然渗透,AI自转飞轮越来越快,人类迈向超级智能时代机遇与挑战并存。
诺奖、金牌与SOTA:谷歌2025八大领域核心突破年终回顾
2025年是AI成为社会基础能源的关键转折点,谷歌通过全栈自研与生态标准双轮驱动构建智能基础设施帝国。从模型推理到科学发现领域均有突破,如Gemini 3系列、Ironwood芯片等,还在各领域有诸多应用与探索。
超20万个高质量Skills!浙大等联合推出SkillNet,告别孤立Skill实现自进化
浙江大学联合多家机构推出开源基础设施SkillNet,拥有超20万个高质量Skills。它能让AI智能体告别失忆式工作,将互联网资源和人类经验转化为可执行Skills,构建Skills网络,经严苛评测,在真实场景验证了强大实战能力。
从过拟合到通用!ViMoGen开启3D人体动作生成新纪元
随着AIGC爆发,3D人体动作生成领域滞后,现有模型泛化能力有瓶颈。南洋理工大学等机构研究人员提出ViMoGen,从数据、模型、评估三方面重新定义通用动作生成路径,还能赋能具身智能。
一手实测!不用研究小龙虾了:腾讯搬出QClaw,直连微信,零门槛
腾讯基于OpenClaw开源生态推出QClaw,主打简单、零门槛部署,可直连主流大语言模型,集成微信能远程操控电脑。还推出SkillHub技能社区,腾讯电脑管家有安全防护功能,但权限问题待解决。
Anthropic揭秘Agent长线开发架构:引入GAN机制,Claude自主撸出全栈应用
Anthropic公开前端设计和自主软件工程最新突破,为让Claude构建完整应用,从GAN汲取灵感设计多智能体协同架构。介绍架构实践、解决的问题及应用效果,还探讨架构简化和设计规律。