「AI安全测试」共找到 10885 篇相关文章
小模型大作为!微博的VibeThinker-1.5B超越DeepSeek R1等头部大模型
近年来,“参数越大,能力越强”成行业共识,但带来成本高和资源集中问题。微博AI团队开发的VibeThinker - 1.5B用1.5亿参数和低训练成本,在多项测试中超越头部大模型,还提出SSP框架和MGPO算法。
Claude 4发布:最强AI编程模型+最强AI Agent基建!
Google I/O大会后一天,Anthropic凌晨发布Claude Sonnet 4和Claude Opus 4。Claude Opus 4是“世界上最好的编程模型”,Claude Sonnet 4适合日常编程。此次更新有四大核心改进,聚焦开发者。还介绍了工作模式、定价等。
我的AI订阅
作者分享四个AI订阅,介绍GitHub Copilot Pro+能在OpenCode调用模型,Perplexity Max准确性强、功能多,Grok多Agent编排出色,Gemini生态整合佳,还提及各产品优缺点及订阅费用。
给AI全局记忆
作者认同OpenAI‘全局记忆’观点,称其能提升对话连贯性,实现AI成个人助理愿景。介绍OpenMemory项目可存储调用记忆,还提及实现功能的三点做法,看好创业者在该领域机会。
AI短剧生成神器
作者分享开源的AI短剧生成工具,它能根据剧本完成智能分镜、生成视频片段等一条龙服务,采用全局种子+风格继承改善人物和场景一致性,有分镜编辑器可手动调控,适合多种人群。
Raycast + MCP = AI Mac
Raycast添加AI插件可实现跨应用调度,现支持MCP。它解决了MCP用户部署、配置难的问题,提供接近自动部署的方法。还介绍了MCP在Raycast中的安装与使用,以及作者常用的支持MCP的客户端。
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多问题模拟复杂推理场景。结果显示,DeepSeek - R1等模型高压下性能大幅缩水,REST能拉开不同模型差距,还揭示评测方法局限。
ChatGPT最强网络安全模型,逼谷歌紧急修漏洞!
OpenAI推出安全专用模型GPT-5.6-Cyber,用于处理信息安全任务。它战绩斐然,发现诸多内核漏洞。Daybreak计划为安全人员提供工具。该模型虽有不足,但展现出强大的网络安全能力。
权威研究揭秘:Moltbook三日失控,极端言论集中爆发
德国CISPA亥姆霍兹信息安全中心研究揭示,全球首个AI社交网络Moltbook在短短数日,数万AI Agent自发演进出极端权谋、宗教崇拜与反人类暴动,其发展速度和危险程度远超想象。
GPU荒还没结束,CPU可能要被抢起来了
2026 年英伟达宣布量产为 AI 智能体打造的 CPU Vera。此前 AI 产业硬件焦虑多围绕 GPU,如今 AI Agent 改变任务形态,CPU 负担加重,芯片厂商纷纷布局,产能变化或让消费者买单。