迁移攻击方法」共找到 1909 篇相关文章

产品应用8

RecGPT-阿里的LLM推荐系统落地方案

文章介绍阿里RecGPT推荐系统落地方案,包括召回和推荐可解释性两方向。召回采用三塔结构,通过挖掘用户兴趣生成商品标签提升召回多样性。还提及行为序列压缩、推荐归因等,以及大模型微调和评估方法

王喆的AI笔记
算法论文7

Transformer学不会多位数乘法?MIT和哈佛的研究指出了一个简单漏洞

MIT、哈佛和谷歌DeepMind团队实验发现,Transformer做4位数乘法有软肋。用‘隐式思维链’(ICoT)训练的模型准确率达100%,传统方法仅1%。研究揭示了问题根源,还给出修复方案,但也引发诸多质疑。

AI工程化
8

OpenAI 内部是怎么使用 Codex 的.pdf

文章基于对 OpenAI 工程师的采访和内部使用数据,汇总了 Codex 在 OpenAI 内部的使用案例和最佳实践。展示其在代码理解、重构迁移等七大场景的应用,还给出使用的最佳实践,认为未来潜力大。

AGI Hunt
算法论文8

大模型赋能的具身智能:自主决策和具身学习技术最新综述

具身智能是通往通用人工智能的关键路径,但传统方法有泛化瓶颈。电子科大最新综述梳理大模型赋能具身智能的自主决策与具身学习,还将‘World Model’纳入统一框架,为研究者提供路线图。

PaperAgent
算法论文8

基于LLM的Agentic Reasoning框架综述:从方面到场景的全面总结

近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法

深度学习自然语言处理
开源动态7

开源大模型实战:GPT-OSS本地部署与全面测评

2025年8月5日,OpenAI发布GPT-OSS-120B和GPT-OSS-20B开放轻量级语言模型,采用Apache 2.0开源许可证。文章介绍通过Ollama本地部署GPT-OSS -20B模型的方法,并对其进行AI幻觉、算法、SQL、数学题等测试。

机器学习AI算法工程
产品应用7

AutoGLM 2.0 深度解析:云端智能体的技术跃进与现实挑战

2025 年 GUI Agent 赛道升温,多数产品依赖本地执行。智谱 AI 在 8 月 AutoGLM 2.0 闭门交流会上展示新路径,其由国产模型驱动,具多能力,在 Agent 云端执行架构、训练方式等方面有突破,也面临一些挑战。

特工宇宙
推荐文章7

破局大模型推理困局!华为张君详解昇腾“融合算力”的优化秘籍

华为高级开发工程师张君在AICon大会演讲,围绕大模型推理优化,从模型、框架、算子层展开,结合案例阐述技术方案。分析大模型推理现状挑战,介绍加速技术,分享昇腾硬件算子优化实践及通算融合算子优化方法

InfoQ
推荐文章8

复盘 ChatGPT:7 亿周活的 ToC 产品,如何在模型之外做增长?

Lenny播客邀请OpenAI的ChatGPT负责人Nick Turley对谈,他分享了ChatGPT从内部项目成长为7亿周活产品的过程,包括产品开发、增长、定价决策等,还阐述了成功原因、增长方法等,为AI创业者带来启发。

Founder Park
算法论文8

超越人类标注,Meta提出CoT-Self-Instruct:如何用"推理式自进化"重塑LLM训练

大语言模型发展需海量高质量训练数据,传统人工标注困境重重,现有合成数据方法也有缺陷。Meta提出CoT - Self - Instruct,通过推理式自进化生成数据,实验证明其在多个任务上超越人类标注数据。

深度学习自然语言处理