「深度学习研究」共找到 3465 篇相关文章
LLM抢人血案:强化学习天才被挖空,一朝沦为「无人区」!
斯坦福AI+CS博士Joseph Suarez回顾强化学习历史,指出其曾因学术短视、学界追名逐利走向衰落。如今他坚持用小模型从零开始的RL,重建标准,让研究速度和效果大幅提升。
生成式视角重塑监督学习!标签不只是答案,更是学习指南 | ICML 2025
上海交大等机构团队在ICML 2025提出预测一致性学习(PCL),通过扩散过程消减标签信息,引入噪声标签,将标签学习分解为渐进式任务,实现标签信息复用。在多模态任务实验中,PCL表现优于传统监督学习。
LLM 语境下,「持续学习」是否是 「记忆」 问题的最优解?
本期通讯解读 3 个 AI 业内要事,包括谷歌嵌套学习范式引争议、AI 产品记忆方向探讨、英伟达合成数据等。谷歌 NL 范式想规避遗忘问题,测试中 HOPE 表现优,但也遭质疑,当前 LLM 研究更关注改善记忆。
南大周志华团队最新力作:一个算法通吃所有,在线学习迎来新范式?
世界是动态变化的,AI 模型需具备在线学习能力,领域提出适应性遗憾值指标。现有算法通用性不足,南京大学周志华团队研究具有双重自适应性的通用算法,提出元 - 专家框架等,还研究了在线复合优化问题。
大模型长脑子了?研究发现LLM中层会自发模拟人脑进化
帝国理工学院等机构研究人员发表论文,指出大型语言模型(LLM)学习中会自发演化出类似生物大脑的协同核心结构。研究对多个模型剖析,揭示其内部处理规律,为大模型可解释性开辟新路径。
清华上交满分论文证明:强化学习并不能让大模型更会思考!
清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让大模型更会思考,推理能力上限仍由基础模型决定。
Claude Code 学习最佳实践:NotebookLM 生成全套学习视频+卡片+测试题
文章介绍用NotebookLM学习Claude Code的最佳实践。有人将36篇Claude Code资料“喂”给它,生成含音视频的学习资料库。NotebookLM能多种形式输出,支持多类型输入,值得纳入日常工作流。
自主金融研究智能体
Dexter是自主金融研究智能体,会思考、计划和学习。它能将复杂金融问题转化为研究计划,利用实时数据执行任务、自我验证。介绍了其核心能力、安装使用方法、架构、项目结构、配置等。
一文读懂深度表格数据表示学习 | 南京大学
南京大学团队系统介绍表格表示学习领域,将现有方法按泛化能力分三类,比较DNN与树模型优劣,剖析核心挑战,探讨扩展方向及数据集评估策略,旨在建跨数据集稳健评估体系。
【深度长文】从“会聊天”到“能干活”:OpenClaw架构深度拆解与价值挖掘
文章深度拆解 OpenClaw 架构,指出传统 SaaS 走向末路,OpenAI Operator 有局限。OpenClaw 以本地原生机制崛起,具备诸多优势,还介绍了其安全方案及五大高价值商业场景,鼓励关注学习。