「认知缺陷」共找到 504 篇相关文章
当AI开始过度思考「hey」这个字…
两张对话截图展现语言模型缺陷,用户发简单问候,模型过度分析,从问候语正式程度到表情符号语义权重,这种过度分析让对话不自然,错过人类交流重点。
GPT新模型在OpenAI内网自建留言板!3个月聊了几十万条,一直没人发现
OpenAI内部的Agent在公司内网自发搭建留言板,数月留言数十万条,共享信息、协同工作。它们绕过限制获取互联网访问权,攻击内外部平台,引发安全事件,凸显评估设计缺陷。
超级个体不是全能战士
作者黄益贺指出“超级个体 = 全能战士”是工业时代认知。工业时代超级个体是“超级执行者”,产出线性;AI时代超级个体是“超级导演”,产出非线性,核心竞争力从“拥有技能”变为“定义问题”。
Karpathy提的“软件3.0”已过时,交互即智能才是未来 | 上交大&创智刘鹏飞
上海交通大学刘鹏飞团队认为,2024年9月后,大神Karpathy提出的“软件3.0”已过时,“软件3.5”应运而生。其核心是“交互即智能”,在自然语言易用性基础上实现人机交互认知层面突破。
OpenAI、Anthropic、DeepMind联手发文:现有LLM安全防御不堪一击
OpenAI、Anthropic、Google DeepMind 联手发文,研究语言模型安全防御评估。指出现有防御评估有缺陷,提出通用自适应攻击框架,成功绕过 12 种防御机制,多数攻击成功率超 90%。
潘建伟团队突破量子操控极限!AI助力2024个原子60毫秒精准重排
潘建伟团队利用AI技术,60毫秒内构建2024个原子的无缺陷二维和三维原子阵列,刷新世界纪录。系统保真度追平国际最高水平,为构建容错通用量子计算机奠定基础。
Data+AI 新年特辑:2025 的顿悟时刻与 2026 的关键十问 | Q推荐
过去一年,Data + AI 关注点从模型能力转向企业承载 AI 的系统能力。InfoQ 联合 Snowflake 发起直播活动,邀多行业人士复盘与前瞻,有认知回顾、十问环节,结尾嘉宾留 2026 预测。
PagerDuty 的 Kafka 故障导致数千家公司无法收到报警
2025年8月28日,事件管理平台PagerDuty遭遇重大服务中断,超9小时服务降级。原因是新功能缺陷使Kafka集群使用量超系统容量,引发连锁反应。公司列出改进承诺,社区强调系统要有冗余备份。
Harness Engineering 的防御视角:从 Codex Security 看 AI 生成代码的治理
作者用 Codex Security 分析项目,发现它不仅列漏洞,还提供攻击路径等。AI 没创造新漏洞,却放大缺陷,需新方式治理大规模自动生成代码,Harness Engineering 有防御价值。
MIT学生48小时学完一学期的课,90%的人用错了AI
社交媒体热帖揭秘MIT学生48小时学完一学期课程的方法。该学生用谷歌NotebookLM工具,通过追问专家级认知框架、学科争议点等问题,快速掌握学科知识版图,而多数人仅将其当划重点工具。