「泛化缩放定律」共找到 455 篇相关文章
微软 Agentic 组织:下一代 AI 系统
微软研究院提出全新推理范式AsyncThink,让LLM从单打独斗进化成带团队的项目经理。它把并发控制转为纯文本协议,经两阶段训练,实验中全方位碾压传统方法,还具跨领域泛化能力。
ENG APPL COMP FLUID | 西北工业大学曹文博、张伟伟等:基于参数化神经网络求解器的层流翼型绕流代理模型
近年来,PINNs在流体力学中受关注,但在高维参数化与复杂流动问题中受限。西北工业大学曹文博团队基于TSONN构建层流翼型绕流参数化求解器,训练出强泛化能力的代理模型,为工程层流气动分析提供新方案。
大突破!实验证明,RL能为LLM注入“创新”能力
此研究挑战‘RL不教新技能’观点,通过‘字符串转换预测’实验证明,RL能让LLM学会组合已有原子技能,形成可泛化、迁移的元技能,还给出模型能力提升路径。
具身智能空间视觉死穴,终于被最新顶会彻底解决!
招商局先进技术研究院下属实验室提出新的移动数据范式,以极低成本破解 VLA 的空间泛化瓶颈。研究团队识别出 VLA 模型三种捷径学习模式,提出层次化数据解耦策略,该方案在主流 VLA 模型上验证有效。
Kimi团队深夜潜入Reddit开了场AMA,他们都聊了些什么?(据说代号4494就是杨植麟本人)
今日凌晨,Kimi团队在Reddit社区开展AMA交流,解答大家疑问。期间回应Claude蒸馏争议,探讨编程写作侧重、小参数模型需求、缩放定律等问题。K2.5表现出色,K3值得期待。
AGI只是硅谷的幻想?!AI科学家盛赞中国,并从物理学角度宣告我们永远造不出AGI
AI科学家Tim Dettmers在博客文章中指出,计算须遵循物理定律,线性进步要指数级资源,硬件升级红利已尽。他认为美国追求AGI和超级智能不切实际,中国重应用普及更务实,AGI难以实现。
挤不动的世界机器人大会上,自变量秀出了真·通用具身智能
2025世界机器人大会上,自变量机器人展示多项成果。通用轮式双臂机器人“小量”“小白”能完成制作香囊、家务整理等任务;“量子2号”仿人形机器人动作精准自然;其具身智能基座模型WALL - A有强大泛化性。
从过拟合到通用!ViMoGen开启3D人体动作生成新纪元
随着AIGC爆发,3D人体动作生成领域滞后,现有模型泛化能力有瓶颈。南洋理工大学等机构研究人员提出ViMoGen,从数据、模型、评估三方面重新定义通用动作生成路径,还能赋能具身智能。
Scaling Laws起源于1993年?OpenAI总裁:深度学习的根本已揭秘
人工智能扩展定律(Scaling Laws)把模型性能和资源投入联系,是构建大模型的参考标尺。其起源说法不一,康奈尔博士生将其推至1993年贝尔实验室论文,OpenAI总裁称它揭示深度学习根本。
直播预约 | Transformer 模型能否通过连接训练数据中的离散知识进行推理?
为研究Transformer是否具备组合式推理能力,提出FTCT合成任务。实验发现Few - shot CoT提示可激发推理能力,训练与测试相似度、模型复杂度影响推理能力。还分析了其内在机制,展示其泛化推理潜力。