「人工干预」共找到 247 篇相关文章
Github持续上榜,这款 AI 自动渗透项目真有点东西!
传统渗透测试依赖人工,效率不高。开源项目PentAGI将‘AI Agent + 渗透测试’结合,能自动完成渗透测试任务,有自主决策能力,功能特性丰富,安装使用较方便,虽有局限但值得尝试。
龙虾惨遭卸载,OpenAI 最新博客:Agent 的安全隐患,可能永远无解
OpenAI 博客指出 AI Agent 安全隐患或无解。三大 AI 巨头投入防御,仍难抵攻击,如 OpenClaw 就出现多起安全事故。其根源是大语言模型架构缺陷,不过‘不可解’不等于‘不可控’,业界已有应对策略。
在AI社会抓「内鬼」?上海AI Lab推出首个多智能体极端事件解释框架
2023年起多智能体系统成人类社会数字镜像,但复杂系统会自发涌现极端事件。上海AI Lab等团队推出解释框架,用沙普利值拆解风险,发现极端事件五大演化规律,还能提前防控风险。
Github 1.8k star Skyvern:AI直接接管鼠标键盘,3行API干掉你写了3年的脆弱XPath脚本!
Skyvern是开源AI浏览器代理,结合LLM和计算机视觉,自动执行浏览器业务流程。它用简单API复刻人工操作,替代传统脚本,解决脚本脆弱、流程复杂等痛点,功能丰富,技术优势明显,适合多业务场景。
大模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制”
近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答大模型能否感知问题难度等问题。研究基于数据集在主流 LLM 上训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。
DeepSeek最会讨好,LLM太懂人情世故了,超人类50%
研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。
适用所有团队研发提效|带你1分钟上手基于Claude Code的AI代码评审实践
文章介绍用Claude Code和AONE MCP Server实现智能AI代码评审。分析当前CR流程痛点,阐述解决方案架构、配置及效果,提效超50%,还给出使用方式、建议与后续优化方向,为团队AI提效提供参考。
bootstrap 到十亿美元 ARR:Surge AI 这匹黑马如何颠覆 Scale 霸权 ?
Surge AI 成立于 2020 年,主创团队低调,短短几年业绩爆发。截至 2024 年 ARR 超 10 亿美元,超越 Scale AI。2025 年 7 月启动首次外部融资,其聚焦高质量数据标注,客户多为顶级科技公司。
别跟LLM太交心!斯坦福新研究:AI不能完全取代人类心理治疗师
斯坦福大学研究团队测试流行AI模型及商业化AI治疗平台,发现AI治疗师存在根本缺陷与潜在危险,如歧视回应、无法危机干预、谄媚等,但也认可其在心理健康方面的辅助用途。
Genspark 将上线 AI 浏览器丨创始人最新分享:我看到了 AGI
Genspark 下周将上线 AI 浏览器。其创始人景鲲发文称,AI 将影响 99% 的人工作,白领工作或消失,应届毕业生可能毕业即失业。他基于使用近 1000 种 AI 产品的经验,认为 AGI 即将到来。