「人工智能安全治理」共找到 1453 篇相关文章
Agent项目最头疼的不是技术,这可能是近期最棒的Agent调研。
MMC深入访谈多家AI Agent创业公司创始人和企业用户,撰写《State of Agentic AI: Founder’s edition》。调研显示创始人头疼的多是非技术问题,还分析了准确率与主动性、定价策略等情况。
2025 年 InfoQ 趋势报告:云计算和 DevOps 篇
InfoQ 2025 年云计算和 DevOps 趋势报告展示技术采用阶段趋势图,介绍新增或更新技术。涉及 AI Agent、MCP、平台工程等趋势,指出云 DevOps 生态成熟有新挑战,新阶段需整合多种要素。
最具争议性研究:大模型中间层输出可 100% 反推原始输入
意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射性,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。
探秘琶洲模方:不只是孵化器,更是“创新沙盒” | 甲子光年
在人工智能浪潮中,琶洲成为科技与商业策源地。2025年5月,琶洲模方启动运营,它突破传统孵化器模式,打造“创新沙盒”,以“一中心四平台”体系对抗技术黑盒不确定性,助力企业成长。
智能旅行助手
开发者开源智能旅行助手 AI Travel Agent Streamlit,集成 OpenAI、天气 API 等服务,可在直观界面完成旅行规划。介绍了设置、运行、部署方法,还提及测试、安全等要点。
Claude Sonnet 4.5 发布,30 小时自主编码刷新行业纪录
Anthropic发布Claude Sonnet 4.5,号称最强编程模型,自主编码达30小时。它性能超GPT-5等,Claude Code升级,文件处理、API能力增强,价格不变,多平台集成,还通过白盒审计提升安全性。
开源|Python 应用往微服务迈进的 1*3 种 Pythonic 步伐
在微服务架构主流的当下,Java凭成熟生态占主导,Python开发者面临尴尬。为此开源了`nacos-serving-python`项目,介绍全新Python微服务解决方案,涵盖服务发现策略、三种自动注册方式等内容。
ICCV 25 Highlight | 扩散过程「早预警」实现6x加速,AIGC生图的高效后门防御
随着AIGC图像生成技术流行,后门攻击威胁开源社区,传统防御技术难适配。本文作者来自多所高校,提出输入级防御框架NaviT2I,基于神经元激活差异检测样本,加速检测,性能优。
加一个字母就可以绕过AI围栏,新的漏洞:TokenBreak
提示词注入攻击威胁大模型及应用,当前主要防护方法是用BERT模型检测。HiddenLayer团队发现TokenBreak漏洞,通过加字母绕过检测。研究表明BPE和WordPiece分词策略易受攻击,Unigram不易,建议优先选Unigram类模型。
通过逆向工程探秘 Claude Code 背后的运作机制
作者通过逆向工程研究Claude Code内部运作,了解其比Cursor等工具慢且贵的原因。Claude Code注重通用性和安全性,执行任务时多有安全检查,虽增加成本延迟,但更可靠,且在命令行工具中用户体验出色。