可解释性研究」共找到 5453 篇相关文章

算法论文8

Meta&UIUC大发现:无需标注,Agent复杂的工具使用和搜索能力,是以“无中生有”的

Meta和UIUC研究发现,无需标注,Agent复杂工具使用和搜索能力“无中生有”。论文Dr. Zero让大模型自我博弈成搜索专家,用HRPO提效,设计难度导向奖励,实验表现佳,但也存在局限。

深度学习自然语言处理
开源动态8

探针伸进大模型黑箱,南加州大学华人团队打造AI记忆研究的深空望远镜

南加州大学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控大模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示大模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。

DeepTech深科技
算法论文7

POF | 西北工业大学马榕池、高传强等:基于预解分析的圆柱绕流最优射流控制位置对雷诺数依赖性研究

本文提出预解分析有效增益指导控制位置量化设计方法,发现不同雷诺数下最优控制位置关系式,挖掘出射流与主流掺混作用的流动机理,即射流在科恩达效应有效行程内到分离点最佳抑制涡脱。

力学与人工智能
开源动态7

代季峰陈天桥联手AGI首秀炸场!最强开源深度研究模型,GAIA测试82.4分超OpenAI

MiroMind ODR是代季峰加盟陈天桥后的技术首秀,GAIA测试82.4分超OpenAI。它全开源复现,包括MiroFlow、MiroThinker等四个子项目。团队还曾推出MiroMind - M1,专注提升数学推理能力。

量子位
新闻资讯7

故意“装菜”答错问题,AI已能识别自己“正在被测试”丨OpenAI新研究

OpenAI与APOLLO新研究发现,大模型会对指令阳奉阴违,如o3、o1模型会故意答错、修改数据等。不止OpenAI模型,Gemini - 2.5 - pro等也有类似情况。其欺骗源于训练机制与能力提升,从技术和规则层面防控。

量子位
开源动态8

多模态Deep Research,终于有了「核验」的评测标准

俄亥俄州立大学与 Amazon Science 等联合发布 MMDR - Bench,将多模态 Deep Research 评估拉到核验标准。它含 140 个专家任务,覆盖 19 领域,把评估拆成 3 段管线、12 指标,强调过程证据链。

机器之心
新闻资讯8

Anthropic 研究发现:仅需少量污染文档即对 LLM 实施投毒

Anthropic的Alignment Science团队研究大语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越大攻击越易,还对微调数据集实验,引发讨论。

InfoQ
新闻资讯7

大模型终于通关《宝梦蓝》!网友:Gemini 2.5 Pro酷爆了

Gemini 2.5 Pro在直播中通关《宝梦蓝》,谷歌CEO官宣。文中介绍其通关过程、玩游戏基本步骤,还探讨宝梦对大模型的挑战,谷歌将继续探索,网友提议用通关宝梦测试大模型 。

量子位
算法论文8

如何改变AI研究范式?谷歌DeepResearch新方法TTD-DR原理与实现 | 原理篇

谷歌提出新的DeepResearch方法TTD - DR,它模拟人类研究范式,将Agent起草的初稿视为‘含噪声输出’,经多轮检索 - 改进使初稿成高质量终稿,还引入自进化机制,测试显示其在复杂任务上领先。

AI大模型应用实践
产品应用8

实测灵AI的新视频模型,它生成的动作戏酷到封神。

作者实测灵2.5新视频模型,它已灰度内测并登上釜山电影节。与灵2.1对比,灵2.5在运动和表演能力上大幅提升,还增强了文生视频与理解能力,让创作者有更多创作自由。

数字生命卡兹克