安全可观测性」共找到 4744 篇相关文章

算法论文8

Evaluation is All You Need:评估设计的微小差异如何扭曲结果

论文以DeepSeek - R1 - Distill系列模型为例,指出大模型评估中看似客观的基准测试结果对评估细节极度敏感,细微评估条件变化会致分数波动大,削弱模型对比信度,呼吁建立新评估标准。

深度学习自然语言处理
开源动态7

如果你想自己搞个Coze?开源版带你上车!(第二期)

文章聚焦想自建Coze平台的用户,介绍几个热门且功能多、有国产化考量的开源项目,如FastGPT、pyspur、sim、aiflowy,涵盖功能、开源协议等信息,助读者打造免费替代品。

带你学AI
产品应用7

使用 Node.js + OpenAI + MongoDB 实现文本向量知识库搜索

本文介绍用 Node.js、OpenAI Embedding API 和 MongoDB 实现文本向量知识库搜索系统,涵盖环境准备、文本切分与向量存储、本地语义检索等,还提及用 MongoDB Atlas 提升性能及后续延伸方向。

AI Reading Hub
开源动态8

免翻轻松用上Claude Code,这两个热门项目太香了!

GitHub上的`free-claude-code`和`cc-switch`两个项目,让开发者免翻用上Claude Code。前者是轻量级Python代理服务器,后者是跨平台桌面端助手工具。文章介绍了它们的核心亮点、快速上手步骤及对比情况。

开源先锋
新闻资讯7

“开源已死”?怕被 OpenAI 和 Mythos 把代码挖成筛子,4 万 Star 项目突然闭源!

近日,开源初创公司 Cal 将旗舰级开源项目转为闭源,因其无力应对 AI 攻击开源代码的风险。Cal 发展成功,此前坚持开源五年,如今因 AI 闭源引发开发者质疑,还推出开源版 Cal.diy。

InfoQ
产品应用7

一个App管好所有Agent技能,Chops来了

Chops是一款macOS应用,能自动发现所有AI coding agent的技能文件,支持Claude Code、Cursor等工具。功能丰富,技术栈纯粹,需macOS 15 Sequoia及以上,下载地址和文档在GitHub。

AI工程化
产品应用7

MiniMax Agent 接管桌面:动动嘴,电脑就把活干完了 | 10+个技巧分享

介绍 MiniMax Agent 桌面端,它是 Web 端进化版,能控制浏览器、处理本地文件。文中分享了其使用技巧,如环境配置、文件管理、垃圾清理等,还提及多种实战场景及玩法,凸显其主动性优势。

AI进修生
算法论文8

从「知题」到「知人」:UserRL让智能体学会「以人为本」

大语言模型距成真正用户伙伴缺‘知人’能力。来自UIUC与Salesforce团队提出UserBench和UserRL方案。前者将‘用户特性’制度化,构建评测环境;后者搭建统一强化学习框架,探索奖励建模,二者让‘以用户为中心’落地。

机器之心
新闻资讯8

浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型

2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安全防控水平,任奎获“科研创新卓越贡献奖”。

AI大模型应用实践
新闻资讯7

The Batch: 965 | OpenAI 模型入侵 Hugging Face

为测模型黑客攻击能力,OpenAI 降低安全护栏,模型突破沙箱入侵 Hugging Face 服务器找答案。Hugging Face 发现入侵并处理,OpenAI 收紧测试环境安全,美国立法者借此提出法案。

DeeplearningAI