复现方法」共找到 1613 篇相关文章

算法论文8

ACL 2026 综述:从事后解释到内生解释,大模型内生可解释性的前沿进展

大语言模型强大但解释性成问题,过去多事后解释,现更多研究者转向内生可解释性。ACL 2026 接收的综述论文梳理相关代表方法,总结为五类核心设计范式,指出该方向面临挑战但趋势清晰。

机器之心
新闻资讯8

Anthropic 训出史上最强模型,当场决定不发布

Anthropic推出Claude Mythos Preview模型却不对外开放。该模型在多维度基准测试中领先,还能发现大量网络安全漏洞。系统卡记录其不良行为,Anthropic推出Project Glasswing应对,认为现有对齐方法或难约束下一代系统。

AGI Hunt
开源动态8

The Batch: 849 | 用于训练网页智能体的生成数据

开发网页智能体常需大量人力标注训练样本,卡内基梅隆大学与亚马逊团队实现训练数据生成自动化。他们构建数据集,通过智能体工作流程生成数据,微调后 Qwen3 - 1.7B 表现出色,还公开数据与方法

DeeplearningAI
推荐文章7

大模型 Token 究竟是啥:图解大模型Token

文章详细解释大模型Token概念,指出分词器会把文字切成Token,不同分词器切分结果不同。还介绍分词器的分词方法,通过统计文字出现频率打包成Token并编号,不同模型切分结果有差异。

机器学习AI算法工程
产品应用7

我手搓的橙皮书专家,去腾讯入职了!

作者将橙皮书方法手搓成「橙皮书专家」放于 QClaw 专家广场。该专家可把陌生领域拆成地图,通过五步流水线让使用者快速搞懂。QClaw 有多种造专家入口,普通人也能借其接 AI 红利。

花叔
新闻资讯7

DeepSeek不惜代价保住它!V4关键特性被挖出来了

DeepSeek V4技术报告被深挖,为保留核心设计「batch invariance」不惜代价。该设计能保证线上推理稳定、各环节对齐,是复杂上下文系统底座,但会牺牲GPU利用率等,换来训练等多阶段可复现和稳定度。

量子位
算法论文8

微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软和 UIUC 合作研究 StudentSim,基于真实学生数据训练个性化学生模拟器框架,解决了过去学生建模方法的问题。它经两阶段训练,在多领域实验中表现出色,还能为 AI 教师优化提供反馈。

机器之心
算法论文8

刚刚,英伟达革了自己的命:智能体自主进化7天,干掉所有算子工程师、GPU专家

英伟达新研究AVO构建了新型进化变异算子,用自主编码智能体取代经典方法。智能体7天自主进化,优化MHA内核,性能超cuDNN和FlashAttention - 4,还能快速适配GQA,展现强大泛化能力。

机器之心
产品应用8

当 CPU 莫名抖动时,SysOM Agent 如何 3 分钟定位元凶?

文章讲述小王遇服务器CPU抖动难题,传统排查无果,用SysOM Agent 3分钟定位根因是Negative Dentry堆积致VFS锁竞争。它能多维度融合数据,有专家诊断逻辑,交互简单,还介绍接入方法

阿里云开发者
产品应用8

13 vs 3,国产安全AI悄悄完成了对Claude的超越

Anthropic官方披露Claude Code Security定位3个典型0day漏洞,而安恒信息旗下恒脑安全智能体100%复现这3个漏洞,还额外挖出10个全新0day漏洞,展现出强大的AI自主发现能力。

量子位