隐藏命令」共找到 143 篇相关文章

算法论文8

年度AI论文!全球三大顶尖模型的防蒸馏机制全面告破:小模型“套出”大模型隐藏思维链,Kimi-K3重现概率异常

这篇论文指出三大前沿AI模型厂商API有密码学旁路漏洞,攻击者用轻量级模型就能恢复大模型隐藏思维链数据。还揭示部分模型训练或借鉴大模型思维链,此漏洞也致企业数据隐私安全问题。

AI前线
开源动态8

看看人家的项目,一行命令即搞定,优雅、好看!

开源君发现神器 Freeze,它由 Charm 团队开发,能将代码文件或终端输出渲染成图片,支持多格式、高度定制,有交互界面,在 GitHub 获 4.4k Star,适合写博客、做分享的人。

开源先锋
算法论文8

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!

论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。

机器之心
开源动态7

20刀月费秒变API!Hermes一行命令就能用上Claude、ChatGPT订阅

两大开源Agent框架有硬核更新。Hermes Agent v0.14用一行命令把模型订阅变API,零成本驱动开发工具,还接入Grok。OpenClaw 5.18修复问题,适配Grok。20美元月费可喂饱工具链,打破生态闭环。

新智元
新闻资讯7

隐藏指令诱导AI给论文打高分,谢赛宁合著论文被点名:认错,绝不鼓励

最近,一些简单提示词在AI学术圈掀起风波,操作者将其隐秘嵌入论文诱导AI给高分。谢赛宁合著论文也涉此事,他紧急回应,承认过失,解释缘由并采取补救措施,还呼吁探讨AI时代科研伦理。

机器之心
算法论文7

一段 signature,不仅撬开了 Opus 的隐藏推理,还让 Kimi、GLM 露出了"熟悉感"

研究者发现,将 Opus 等强模型返回的加密推理块交给同家族弱模型,弱模型可能转写出隐藏内容。如用 Haiku 读取 Opus 的加密信息。此外,公开的 Agent 轨迹存在隐私泄露风险,部分开源模型易受 Opus 风格影响。

深度学习自然语言处理
算法论文8

想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了

马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。

机器之心
算法论文8

开源模型竟被用于窃取下游微调数据?清华团队揭秘开源微调范式新型隐藏安全风险

清华、墨尔本大学团队研究指出,基于开源模型微调专有模型存在新型隐藏安全风险,开源模型发布者可埋后门窃取下游微调数据,新风险难检测、危害大,目前攻防方法待改进。

机器之心
算法论文8

AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

2026年4月28日,Anthropic联合剑桥大学发布论文,提出“内省适配器”技术,可让大模型用自然语言“坦白”微调中学到的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。

AI科技评论
产品应用7

Clawdbot 教程 01:模型的配置和切换

作者分享 Clawdbot 模型配置和切换教程,指出配置核心问题是命令行配置与 URL 修正,可用 openclaw configure 命令,不行则手动改配置文件,还介绍模型切换、避免 no output 问题等方法。

歸藏的AI工具箱