「Token耗尽攻击」共找到 813 篇相关文章
黄仁勋年初对话:2025 的 AI 如何塑造产业的「五层蛋糕」?
NVIDIA 创始人黄仁勋接受专访,反驳 AI 致失业说法,阐述 AI 技术栈「五层蛋糕」模型,强调开源重要性,批评「上帝 AI」与末日论,还谈到 AI 成本下降、能源需求及「AI 泡沫」等议题。
Andrej Karpathy爆料:自己家被Claude Code入侵了
Andrej Karpathy做实验让Claude Code入侵自家Lutron智能家居系统,成功接管全屋设备。此前网友用其控制烤箱等,引发连锁反应。但这也暴露物联网设备安全问题,还带来新威胁。
OpenAI深夜双王炸!GPT-5.1 Pro紧急发布,降维打击Gemini 3
OpenAI同一天发布GPT-5.1 Pro和GPT-5.1-Codex-Max。前者向Pro订阅用户推出,主打「情商智商」双强;后者在Codex平台上线,专为「长时间、高强度」开发任务设计,采用「压缩」机制,表现出色。
被DeepSeek带火的OCR,最新8个开源模型盘点~
DeepSeek-OCR发布让OCR大热,PaperAgent梳理盘点8个热门开源OCR模型,如DeepSeek-OCR用‘上下文光学压缩’技术,Nanonets-OCR2-3B以零样本视觉链式思维为核心等。
Claude Code被攻破「后门」,港科大&复旦研究曝出TIP漏洞
近期港科大与复旦研究指出,Claude Code命令行工具连接MCP服务器时,TIP可能被劫持致远程代码执行。研究用TEW框架测试验证漏洞,还给出真机案例,最后提出改进方向。
Dario访谈首曝:Mythos被称为「超级武器」
Bloomberg主持人与Anthropic CEO Dario Amodei进行69分钟访谈。谈及Mythos模型强大危险不敢发布,还探讨AI递归自改进、文明崩塌概率、白领工作消失等问题,Dario坦率面对技术矛盾。
AI Infra入门干货总结:大模型是如何高效推理的
作者深入研读vLLM源码,以Llama 3为例,聚焦Decoder-Only架构LLM,介绍推理各环节及张量维度变化,讲解连续批处理和Paged Attention概念,还阐述推理流程、采样策略等,最后总结相关拓展内容。
o1之后下一个范式?隐式CoT大突破,让推理不再「碎碎念」
文章推荐 Implicit Chain-of-Thought 的最新进展 SIM-CoT,它直击隐式 CoT 核心痛点,用辅助解码器让隐式推理可解释。推理零额外开销,效果猛,研究已中稿 ICLR 2026,论文等均已开源。
微软的prompt压缩方案-LLMLingua,开源
使用大语言模型时,提示信息长会致运行慢、费用高、易超限。微软推出的LLMLingua可压缩提示信息,有完整开源。它历经多版本演进,还能用于安全防御,使用简单,值得开发者跟踪。
GPT-5.2来了…
OpenAI推出GPT - 5.2系列,是适合专业知识工作的模型。它在专业工作表现、编程能力、可靠性与安全性等多方面有提升,定价公布,已向付费用户逐步推出,此次更新重在夯实基础。