推理可解释性」共找到 5628 篇相关文章

算法论文8

一个指令误导智能模型!北航等首创3D语义攻击框架,成功率暴涨119%

北京航空航天大学与中关村实验室团队提出全新框架InSUR,入选NeurIPS 2025。该框架基于指令生成对抗样本,首次实现3D SemanticAE生成,从采样、建模、评估三方面突破,实验验证其有效性与扩展性。

量子位
推荐文章7

Claude Code没有“魔法”

资深工程师 Daisy Hollman 在演讲介绍了 Claude Code 插件设计与上下文工程原语,以及 Anthropic 内部多 Agent 工作流。指出定制模型放大能力,上下文窗口是关键,还探讨多种插件抽象与工作流扩展方式。

InfoQ
新闻资讯8

李飞飞发布世界模型新成果:一个提示,生成无限3D世界

李飞飞创业团队World Labs宣布能生成持久、导航且能自定义操控的3D世界。该模型专注构建3D环境,有更好几何形状、多样风格、更大规模,还支持无限畅游,已推出beta版。

量子位
产品应用8

把20亿参数装进胸针?高通补齐了个人AI生态的最后一块拼图

在MWC巴塞罗那展会上,人们渴望专属AI智能体。高通认为AI须进驻微型载体,推出骁龙穿戴平台至尊版,将AI运算能力延伸到微型设备,其还构建以用户为中心的生态,让私人助理融入生活。

量子位
新闻资讯7

AMD发布旗舰AI芯片,称性能比肩英伟达

当地时间6月12日,AMD CEO苏姿丰在大会展示多款AI新品,将新AI芯片与英伟达同类产品对比,称性能比肩且性价比高。还展示了新软件栈、介绍下一代AI机架产品,预计推理成未来AI发展主驱动力。

芯师爷
算法论文8

警惕!大模型成本倒挂:你正在为模型的多余「思考」买单

一项来自多所高校和微软研究院的研究揭示AI模型价格倒挂现象,低定价模型能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
8

现实版“盗梦空间”?欧洲极客论文全网爆火,一战戳破三大巨头安全神话,35万机密在公网裸奔

欧洲两位安全研究员的论文《从专有 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“无状态架构”有漏洞,能利用小模型解码大模型推理轨迹,导致隐私泄露等风险。

AI科技大本营
产品应用7

Hermes 登顶 OpenRouter 之后,我才发现它最缺的那一块,被这个插件补上了

Hermes Agent 三个月登顶 OpenRouter,虽好用但记忆处理有缺陷,记忆库成大杂烩。记忆张量的 MemOS Local Plugin 2.0 解决此问题,采用‘执行即学习’,有双层反馈机制,且资产携带。

AI工程化
算法论文8

Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?

LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。

深度学习自然语言处理
开源动态8

字节Seed团队发布循环语言模型Ouro,在预训练阶段直接「思考」,Bengio署名

现代LLM依赖显式文本生成训练“思考”,未充分挖掘预训练数据潜力。字节Seed团队联合多家机构推出循环语言模型Ouro,将推理能力构建到预训练阶段,实现参数效率提升,还降低了有害性。

机器之心