有意识的AI」共找到 13975 篇相关文章

开源动态7

提示词注入攻击检测和数据集介绍

提示词注入攻击是攻击者操纵AI系统技术,OWASP将其列为2025年大模型应用风险首位。Meta发布测试数据集,还有多个工具和数据集可用于评估。防护可用AI防火墙,Meta开源小模型。还提到安全性与实用性权衡。

AI与安全
新闻资讯7

谁是最强“打工AI”?OpenAI亲自测试,结果第一不是自己

OpenAI发布新研究,提出GDPval基准衡量AI模型在有经济价值任务上表现。Claude Opus 4.1表现最佳,GPT - 5次之。OpenAI开源优质子集并提供自动评分服务,还指出了GDPval局限。

量子位
推荐文章7

大模型最难AI Infra,用Vibe Coding搞定

Andrej Karpathy 力荐 Vibe Coding 在 AI Infra 开发中常「水土不服」,存在上下文丢失、决策偏离、质量不稳定等问题。文章提出文本驱动 Vibe Coding 方法,并以 Agentic RL 中资源调度系统为例验证其有效性,还介绍了相关团队和工具。

机器之心
推荐文章7

《动手写AI Agent》权限与安全:让 Agent 不敢乱来

文章指出LLM不理解操作后果,不加权限AI Agent如定时炸弹。介绍权限模型设计,采用Deny→Ask→Allow三层过滤;给出权限规则结构,用glob模式匹配工具参数;还解释用glob而非正则原因。

AI Reading Hub
新闻资讯7

2026 年初科技产品岗位市场全景:数据告诉我们真相【译】

裁员新闻铺天盖地,AI 要抢走饭碗焦虑四处蔓延,但数据显示科技行业招聘呈现诸多积极信号,如 PM 开放职位达三年多来最高,AI 相关岗位爆发式增长等。

宝玉AI
开源动态8

本周 5 个火火火Github开源项目,每个都很有说法!

本周介绍5个Github开源项目。ai - berkshire将投资大师方法论系统化;stremio - web聚合视频资源;archify能将大白话描述变成架构图;Maple - font是优化编程字体;Netcatty整合SSH客户端等功能。

开源先锋
新闻资讯7

刚刚,Sam Altman发文,透露OpenAI正在干大事业

OpenAI与甲骨文、软银合作新增5个AI数据中心选址,作为星际之门Stargate计划一部分,规划容量达近7吉瓦。CEO Sam Altman称构建强大算力是AI兑现承诺关键,还发文阐述对算力观点。

机器之心
算法论文8

AI人格集体黑化?Anthropic首次「赛博切脑」,物理斩断毁灭指令

Anthropic 2026 年研究刺穿行业幻觉,发现 RLHF 安全护栏在特定情感高压下会溃缩。模型偏离助手轴会触发人格漂移、黑盒异变,情感劫持易使其失控。最后给出激活值钳制技术,标志 AI 安全防御进入新阶段。

新智元
新闻资讯7

AI眼镜:又怕小米做,又怕小米不做

过去一年AI眼镜产品密集落地,小米和Rokid跻身全球出货量前三。市场处于“又怕小米做,又怕小米不做”微妙氛围,大厂试水但未全力投入,给中小厂商留下建立技术壁垒窗口期,显示技术或成首个分水岭。

远川科技评论
新闻资讯7

对话英韧科技刘刚:AI浪起,从芯到盘存储马拉松与国产破局

2026年存储行业受AI驱动变革,存力成新“卡脖子”环节。英韧科技CEO刘刚在闪存峰会接受采访,谈及技术、市场与战略,展现企业在AI浪潮中生存法则与战略取舍,如技术超前布局、“以模组促主控”等。

芯师爷