「回归方法」共找到 1761 篇相关文章
又走一个!OpenAI研究VP离职,转投Anthropic做RL研究员
OpenAI研究副总裁Max Schwarzer宣布离职,转投Anthropic做RL研究员。他曾主导o1、o3和GPT - 5系列post - training,因渴望回归一线研究而离开。OpenAI近年人才流失严重,而Anthropic虽面临与五角大楼交锋危机,但仍吸引人才。
OpenAI失去了「CUDA内核之神」
近日热传Scott Gray已离开OpenAI。这位有「CUDA内核之神」称号的工程师声名起于Nervana Systems,加入OpenAI后贡献颇多。2026年OpenAI已流失不少人才,他的离开对公司影响值得关注。
四问智谱上市|甲子光年
2026年1月8日,智谱AI在港交所上市。本文围绕其上市提出四问:是否为“中国OpenAI”、投资人押注点、商业模式健康度及“钱路”方向。指出它应卸下标签,回归技术与商业本质。
Claude Skills 写作指南:从0到1看完就会,不会来找我
本文介绍Claude Skills写作指南,指出传统提示词使用麻烦,而Skills能解决问题。阐述其适用场景、定义、原理,还讲了创建方法、作者实践及完整写作工作流,可按需管理提示词。
ACL 2025 | 大模型乱试错、盲调用?KnowSelf让智能体有「知识边界感知」能力
ACL 2025 论文《Agentic Knowledgeable Self-awareness》聚焦提升智能体「知识边界感知」能力。KnowSelf 方法让智能体自主调节知识运用,实验显示其性能优,还探索了智能体自我认知多方面影响。
只看图片就能学会压缩Token!浙大&阿里新框架多轮VQA压缩率90%,精度不掉|CVPR 2026
多轮视觉问答成LVLM推理效率“照妖镜”,现有压缩方法在多轮场景翻车。浙大宋明黎教授团队与阿里联合提出MetaCompress框架,可根据图像生成最优压缩映射,实验验证其效果优,能平衡压缩率与精度。
AI时代,最老的设计哲学反而最有效
50年前的Unix哲学‘万物皆文件’和‘文件夹即应用’正以意想不到的方式回归。过去因‘人类可理解性’被推崇,如今因AI能操作而重获重要性,文件夹成‘智能空间’,AI成其操作系统。
CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning
大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。
这个推理模型:HRM ,只用2700万参数,超越了DeepSeek和Claude
Sapient Intelligence研究者受大脑机制启发提出分层推理模型HRM,它是全新循环架构,仅2700万参数、1000个训练样本,就在复杂推理任务上表现卓越,还引入近似梯度等方法,有推动通用计算变革潜力。
仅用图像也能Think:Google等提出一种视觉规划的全新推理范式!
剑桥和Google等提出并开源视觉规划范式,通过纯视觉表示规划,独立于文本。还引入VPRL框架,用GRPO后训练大型视觉模型。实验选三个视觉导航任务,VPRL表现最佳,显著优于其他方法。