观测暴露度」共找到 501 篇相关文章

推荐文章8

产品经理必读:AI智能体架构指南——为什么能力强不等于用户爱用?

文章为产品经理打造AI智能体架构指南,以客服智能体为例,阐述四个架构层面决策,分析主流架构方法优劣,还指出构建智能体要注重信任策略,第二部分将探讨自主性决策和治理问题。

宝玉AI
算法论文8

Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性与效率

传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AI与UCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调超参数下,提升推理准确性与效率,本文对其全面解读。

深度学习自然语言处理
新闻资讯7

GPT-5系统提示词突遭泄露,17803 token曝光OpenAI小心思!

一份全新GPT - 5系统提示词在GitHub泄露,有17803 token。此提示词设计精细,覆盖用户对齐、拟人风格、输出质量等。还展示了通用关键要求、安全对齐等方面内容。

新智元
8

AI 陪伴赛道,会诞生下一个「泡泡玛特」吗? | GAIR Live

AI科技评论组织“AI陪伴”线上圆桌,多位从业者探讨AI陪伴是否伪命题、不同人群接受、产品核心价值等,还讨论IP对AI硬件的重要性、硬件与软件优势、是否出海等问题。

AI科技评论
算法论文8

5700问答对全面评估拷问AI空间感!最新空间智能评测基准来了丨浙大&成电&港中文

当前视觉语言大模型空间信息学习片段化,缺乏多维空间推理能力。浙大、成电和港中文团队提出ViewSpatial - Bench基准体系,评估主流模型,揭示其缺陷,并开发MVSM优化跨视角空间理解。

量子位
推荐文章7

面对MCP"工具投毒",我们该如何应对

近期MCP爆火但安全风险显现,安全机构指其有严重漏洞,会致‘工具投毒攻击’。本文介绍通过客户端/服务器代码复刻攻击过程,剖析MCP客户端和服务端安全风险,还给出阿里云的两种安全监控方案。

阿里云开发者
开源动态8

大模型开网店,谁是经营高手?E-Commerce Bench开源揭秘

为评估模型长程经营能力,联合淘天集团发布E-Commerce Bench,以10万本金、365天经营网店来评测。从多维评估18个模型,结果差异大,还发现单一指标会掩盖模型表现,评估基准潜力大。

千问大模型
新闻资讯8

国货之光!全球AI存储基准测试MLPerf Storage 3.0结果发布,斩获九项第一|甲子光年

9月1日,MLPerf Storage 3.0基准测试结果发布,XSKY星辰天合旗下MeshFS首次参赛,在并行文件存储赛道获九项第一。该测试覆盖多类负载,可多维衡量存储系统性能,MeshFS兼顾性能与成本效率。

甲子光年
新闻资讯8

刚刚,奥特曼炮轰达里奥「反人类」!绝密模型同日曝光

OpenAI员工「手滑」暴露模型代号gpt - nathree,引发GPT - 6 Astra将至的猜测。Anthropic也有新模型曝光。同时,奥特曼在播客中认错、怒批行业营销话术,还分享了OpenAI的创业历程。

新智元
新闻资讯8

从15个研发配1个设计,倒挂成1个研发配2个设计!OpenAI设计主管:现在是有史以来 成为设计师的最佳时机

在科技行业,产品设计师与用户研究员对职业前景焦虑、满意低,而OpenAI产品设计负责人Ian Silber认为当下是成设计师最佳时机。他与Lenny探讨AI时代设计变革,分享应对策略、人类设计师价值等观点。

AI科技大本营