「安全评测」共找到 1493 篇相关文章
突发!OpenAI深夜推出浏览器ChatGPT Atlas:一文深度详细解析「率先支持mac OS」
OpenAI推出人工智能驱动的浏览器ChatGPT Atlas,集成对话式AI改变上网方式。它有随行聊天、浏览器记忆、代理模式三大核心功能,面向全球macOS用户上线,更高级功能对付费用户开放,还注重安全与用户控制。
00后挑大梁!近20国选手激战外滩大会,AI科创赛三赛道冠军诞生
9月10日,2025外滩大会AI科创赛在上海落幕,设三大核心赛事,80个项目获奖。00后成主力,近20国选手参与。大赛提供资源支持,AI硬件赛受青睐,金融与安全赛道涌现创新方案,还开源数据集。
Claude Code把自己的提示词删掉80%,我照着砍了自己的60%
Anthropic将Claude Code系统提示词删减超80%,编码评测表现无明显下降。文章阐述删减背后判断,给出六条变化策略、四类文件写法及两条方法论,还介绍实施步骤,作者按此精简提示词约60%。
比「小龙虾」更能打,中国AI视频大模型悄悄登顶全球第一
昆仑万维旗下 SkyReels-V4 Preview 版在权威评测平台超越 OpenAI、Google 等模型,登顶全球第一。它提升语义理解和逻辑能力,新增参考任务,还支持多语言短剧生成、视频编辑等,将在中关村论坛亮相。
AI 医疗还在比进度,百川已在比高度
近一年来,AI医疗进入新阶段,众多企业和资本涌入。但当前主流医疗大模型有局限,落地难。百川Baichuan - M3聚焦医疗决策过程建模,三项关键评测达全球最优,或代表AI医疗重要转向。
阿里开源AgentScope 1.0,多智能体从开发到部署一条龙服务
大语言模型发展下,多智能体系统开发面临诸多难题。阿里通义实验室开源AgentScope 1.0框架,以开发者为核心,有三层解耦架构,模块化设计,还解决安全和管理问题,在工程化特性上优势明显。
从传统编程转向大模型编程
文章指出大模型编程时代,开发者要从‘代码产出者’变为‘文档定义者’,介绍其优势、人+AI结对编程模式,还提及模型工具技巧、开发流程、常见陷阱及应对策略,强调文档驱动和安全合规。
打破学科壁垒!400篇参考文献重磅综述,统一调查「人脑×Agent」记忆系统
哈工大等多机构联合发布重磅综述,打破认知神经科学与人工智能学科壁垒,统一审视人脑与 Agent 记忆系统。文中剖析记忆定义、作用、分类、存储、管理等,还提及评测、安全问题及未来多模态记忆、技能迁移方向。
震撼实锤!清华姚班校友揭「1.4×加速」陷阱:AI优化器为何名不符实?
为降低大模型预训练成本,近年新优化器频出,宣称加速1.4×到2×却难落地。斯坦福研究指出方法学缺陷,对比不同缩放范式加速差异,给出优化器设计见解,证实严格基准评测必要。
谷歌MCP Toolbox for Databases拆解:助你快速构建数据访问智能体的神器
企业Agent运行常需访问数据库,但会遇到工程问题。本文详解谷歌开源项目MCP Toolbox for Databases,介绍其概念、好处、使用方式,还展示安装、配置、启动过程及不同模式下使用方法,兼具安全管控与可观测性。