包幻觉攻击」共找到 509 篇相关文章

新闻资讯7

绕过Azure AI 护栏的方法及案例

本文指出Azure AI有安全漏洞,攻击者可利用漏洞绕过内容安全机制。介绍了重现步骤,阐述字符注入与对抗性机器学习规避两种攻击技巧,展示攻击效果,还提及微软已部署缓解措施并给出安全建议。

AI与安全
开源动态8

不增加人手,项目效率飙升45%,OpenAI公开了一套AI实战经验

OpenAI公开基于大语言模型和专属Skill的开源仓库维护方法论,将重复工作自动化,使项目代码合并吞吐量飙升45%。该方法由AGENTS.md、Skill和GitHub Actions构成,还涉及任务分配、验证策略等。

AIGC开放社区
新闻资讯8

大语言模型 + 编程智能体 = 安全噩梦

作者结合黑帽大会英伟达演讲,指出大语言模型和编程智能体扩大攻击面。如攻击者利用公共资源留恶意指令,实施水坑攻击。强大编程智能体虽普及,但易造成安全漏洞,虽有防御措施但效果有限。

宝玉AI
新闻资讯7

月下载量近亿的AI组件被投毒!Karpathy惊呼软件噩梦,你的所有密钥可能瞬间被偷光

知名AI底层依赖库LiteLLM的PyPI发布版本遭遇供应链攻击攻击者可卷走机器关键凭证。其月下载量近亿,传染性强。虽带毒版本很快被发现,但凸显供应链攻击风险,让Karpathy改变软件工程观念。

AI寒武纪
产品应用8

88天登录193次!顶级证据+循证医学,让500万中国医生拥有「神助攻」

国内医生面临高负荷工作与医学知识快速更新的挑战,通用大模型在医学场景中存在高幻觉率问题。阿里健康推出医学AI产品「氢离子」,具备低幻觉、高循证特点,有四层循证架构,还与多方合作构建数据壁垒。

机器之心
算法论文8

NeurIPS 2025|指哪打哪,可控对抗样本生成器来了!

近日,清华大学和蚂蚁数科在NeurIPS上联合提出Dual - Flow新型对抗攻击生成框架。它能从海量图像数据学“通用扰动规律”,对多模型、多类别发起黑盒攻击,为AI安全带来挑战,已用于蚂蚁数科产品。

机器之心
产品应用8

Genie 3,让幻觉持续成为现实

Google最新发布的Genie 3能从文本生成交互式世界,实现24fps实时交互,分钟级一致性,720p分辨率。它取长补短,有出色记忆能力,物理表现自然,还能让智能体完成任务。不过目前是有限预览,有不足。

AGI Hunt
产品应用7

一分钟的奇迹与幻觉:实测世界模型Happy Oyster

4月16日阿里发布世界模型Happy Oyster,支持多模态输入与音视频联合生成。实测显示,它在场景构建、渲染上有优势,可替代部分传统引擎工作,但存在一致性不足问题,现阶段更适合改造游戏开发流程。

AI科技评论
开源动态7

谷歌 Java 代理开发工具新增 LangChain4j 集成

谷歌 Java 代理开发工具(ADK)0.2.0 版本集成了 LangChain4j,显著扩展功能,让开发者能使用更多模型。谷歌开发者 Guillaume Laforge 解释其优势,ADK 还引入系列增强提升性能。

InfoQ
推荐文章7

相信大模型成本会下降,才是业内最大的幻觉

很多AI创业者认为模型降价能降成本、改善营收。但文章指出,成本下降仅针对老旧模型,最好模型成本大致相同,且模型token消耗激增。还探讨了AI创业商业模式,如按使用量计费、建立高切换成本、垂直整合等。

Founder Park