「模型可解释性」共找到 10038 篇相关文章
AgentA/B:用AI模拟用户,真人AB测试或将成为历史
宾夕法尼亚州立大学和亚马逊合作研发AgentA/B测试框架,用大语言模型生成虚拟用户模拟真实行为,成本低、速度快,还能绕开真实流量测试。虽有人质疑,但它或改变传统AB测试。
AI 办公智能体横评:纳米Work / WorkBuddy / 豆包工作,谁才是理想AI助理?
本文作者亲测纳米Work、WorkBuddy、豆包工作三款热门AI办公智能体,从生态适配、模型支持、价格、实际任务完成度多维度对比,帮读者根据自身办公场景选到合适的AI办公助理。
GPT-6 Sol被曝即将发布?内部「AGI」已浮出水面
本文整合X平台多方信源爆料,曝光OpenAI即将发布的GPT-6 Sol的定位、定价、技术背景,同时爆料Anthropic将提前发布新品截胡,还披露GPT-6 Astra的口碑争议与推迟发布的安全漏洞问题。
华为首发企业AI白皮书:AI让员工更快了,怎样让整个企业受益?
本文为量子位报道,华为在全联接大会2026首发企业AI白皮书,针对当前企业AI单点提效难转化为整体业务收益的痛点,提出企业智能化建设的参考架构与工程落地路径。
Claude王座失守!OpenAI一夜反超,神秘GPT‑6 Sol偷跑
本文报道AI大模型领域最新战局,OpenAI在OpenRouter平台的开发者Token消耗付费流水,首次超越Anthropic Claude,终结了Claude两年半的统治,同时神秘GPT-6 Sol偷跑曝光,双方开启终极对决。
零样本刷新三项基准:ZeroDiff++让AI边考试边学习 | TPAMI'26
本文介绍发表于IEEE TPAMI 2026的ZeroDiff++模型,是ICLR 2025 ZeroDiff的扩展工作,针对生成式零样本学习的虚假语义关联、分布脱节问题提出新框架,在三项主流基准刷新成绩
完成过亿融资,复旦博士要为不同端侧场景定制专属推理芯片丨对话淬思科技潘鸿洋
本文是对淬思科技创始人潘鸿洋的专访,潘鸿洋为复旦博士,淬思科技刚完成新一轮亿元融资,瞄准端侧AI推理成熟阶段的碎片化需求,主打定制专属推理芯片,采用AI原生设计流程压缩开发成本与周期,计划推进首颗商用芯片流片。
大厂这波Agent混战,杀死10多个AI名品
2026年8月AI圈组织架构调整频繁,阿里、字节整合多款产品,腾讯、百度也有动作。办公Agent成大厂混战核心,虽有产品被整合,但各厂优势不同,终局难测。
我去,终于找到原因啦,58.4k Star MemPalace,不敢相信!!!!
AI编程中,上下文压缩后易丢失关键信息。MemPalace将对话和资料按原文存本地,按项目和主题精准找回。本文讲清其存储与检索原理、使用场景、注意事项及安装建议。
刚刚,Claude水印一夜变废纸!
今早GitHub上一个去水印神器代码库爆火,狂揽11000颗星。它采用MIT开源协议,能抹除Claude等水印及相关文件鉴权数据。此前Anthropic高调展示水印技术,如今防线被打破,引发开发者对大公司傲慢的反击。