小样本学习」共找到 2422 篇相关文章

算法论文8

北航团队提出新的离线分层扩散框架:基于结构信息原理,实现稳定离线策略学习|NeurIPS 2025

北航彭浩团队提出SIHD框架,基于结构信息原理,自适应构建多尺度扩散层级,实现稳定离线策略学习。通过构建状态拓扑图、用结构信息增益引导扩散、引入结构熵正则化器,在D4RL测试中表现出色。

AI前线
算法论文8

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

大模型微调(SFT)是主流LLM落地方案,但大家默认训练完就是学完了。腾讯混元团队发现SFT存在不完全学习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。

量子位
开源动态8

32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理模型 AM-Thinking-v1

2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索体量实现大能力路径。

AI科技评论
推荐文章7

智能流体力学专题研讨会特邀报告3|边鑫:混合深度学习与迭代方法的粘性不可压流动加速求解

2026年8月,第十四届全国流体力学学术会议在青岛举行,智能流体力学专题研讨会展示了人工智能与流体力学交叉领域进展。边鑫作《混合深度学习与迭代方法的粘性不可压流动加速求解》报告,介绍HyDEA求解框架。

力学与人工智能
算法论文8

AST | 西交大刘子扬、陈刚等:直接嵌入流场特征的智能化气动外形优化经验学习框架

传统气动外形优化方法有局限,本文提出智能化优化经验学习框架,结合DNN流场预测模型与DRL优化方法,还提出自适应网格再生成技术与Sigmoid奖赏函数,经验证效果良好,为气动优化提供新路径。

力学与人工智能
开源动态8

又是王冠:27M模型超越o3-mini!拒绝马斯克的00后果然不同

27M模型HRM由拒绝马斯克的00后王冠开发,超越o3 - mini - high和DeepSeek - R1,推理不靠思维链。它采用分层推理等五项核心技术,在多测试中表现出色,虽被指通用性不足,但有人看好其仿脑架构。

量子位
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、模型在路上,还承诺尽快发新模型!

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推模型是重点,还承诺尽快发新模型,也探讨了大模型发展观点。

AI前线
推荐文章7

与三位前沿研究者聊AI Agent:规则、环境与热潮下的真问题|五源酒馆Vol.31

五源酒馆对话三位AI Agent前沿研究者,探讨其发展进展、挑战。他们分享对Agent定义、能力边界判断等,提及过去技术突破,如DeepSeek工作,也指出通用Agent瓶颈,探讨未来模型能否提有价值问题等。

五源资本 5Y Capital
开源动态7

一周斩获8k星!港大开源AI学习助手,学练研全流程覆盖,教师也要失业了?

港大开源的DeepTutor是AI个性化学习助手,利用多智能体协作等技术,有文档问答、难题解析等四大核心功能,能构建专属知识库,提供全流程辅导,为学、练、研打造一体化平台。

开源AI项目落地
产品应用8

全球首创!B站推出影视级TTS语音模型,支持零样本语音+情绪双克隆,精准时长控制!

近日,B站语音团队推出全新一代语音合成模型IndexTTS2,提供影视级音质、情绪克隆和时长控制。其情绪与时长精细控制功能全球首创,还具备零样本语音克隆等能力,支持本地运行与中英文双语。

开源星探