渗透测试」共找到 1774 篇相关文章

新闻资讯7

安全的下一个好赛道,非常值得研究

近几年机器人发展火爆,摩根士丹利预测到2050年产业规模或超5万亿美元。但机器人领域安全复杂,研究团队用CAI框架对三款消费级机器人渗透测试,揭示严重安全问题,且行业整体对安全无知。

AI与安全
开源动态8

国产大模型新SOTA:蚂蚁万亿级旗舰模型赶超GPT-5

蚂蚁集团开源万亿参数旗舰大模型Ling-1T,属Ling 2.0家族。它激活比例低降低运算成本,训练有“Ling缩放定律”等方法,多项测试超主流模型,不过处理超长上下文成本较高。

AIGC开放社区
开源动态8

马斯克转发字节Seed&哥大商学院新基准:大模型搞金融,连查个股价都能出错

字节跳动Seed团队与哥大商学院推出开源金融搜索与推理基准测试FinSearchComp,含635个问题。评测显示大模型处理金融任务有差距,凸显金融AI能力评估重要性,还揭示了关键能力差距。

量子位
新闻资讯7

马斯克周末血裁xAI 500人

上周四晚,xAI内部突袭测试,淘汰率达33%,超500人被裁。此前其数据标注团队规模持续增长,多为直聘。此次战略转变,将扩专业标注员规模,或押注垂直行业AI。

量子位
新闻资讯7

GPT-5 之后,我们离 AGI 更近了,还是更远了?

2025年8月8日OpenAI发布GPT-5,架构有革新,在基准测试成绩优异,但跑分现场PPT出错、被Grok 4击败。它在编程表现出色、价格有竞争力,写作能力有争议,模型幻觉和提示注入攻击问题待解。

AI科技大本营
开源动态8

碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用能力超强

国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用能力强。测试显示其性能碾压DeepSeek V3等模型,训练流程还有独特技术创新。

AIGC开放社区
算法论文8

开启 AI 自主进化时代,普林斯顿Alita颠覆传统通用智能体,GAIA榜单引来终章

普林斯顿大学AI Lab推出通用智能体Alita,秉持「极简即是极致复杂」哲学,采用「最小化预定义」与「最大化自我进化」设计范式,可自主创造MCP工具,在GAIA基准测试中表现卓越,还能实现MCP复用。

机器之心
开源动态8

微软正式开源UFO²,Windows桌面迈入「AgentOS 时代」

微软研究团队正式开源业内首个深度集成 Windows 操作系统的桌面智能体平台 UFO² AgentOS。它是 UFO 升级版,解决传统智能体问题,在多维度实现突破,经测试表现领先,代码和文档已开源。

机器之心
产品应用7

我在微信免费养「龙虾」,玩到上瘾,这组CP太强了

2026 开年「龙虾热」渗透各类任务场景,腾讯动作密集。其自研 WorkBuddy 优势明显,与微信 ClawBot 联动成「官配」。经测试,它能高效处理多类任务,还为用户提供权益,腾讯龙虾矩阵加速成形。

机器之心
算法论文8

黎曼猜想推至理论边界99.55%!元代理架构AI:在思考中重塑大脑

科学家面临让AI解决复杂科学难题的问题,传统固定架构AI处理特定复杂问题不顺手。近日学术团队提出Eureka架构,能让AI动态“生长”专用“大脑”,在测试中表现出色,还在数学和物理领域有重大成果。

新智元