自监督训练」共找到 3062 篇相关文章

算法论文8

首个测试时共进化合成框架TTCS:在「左右互搏」中突破推理瓶颈

厦门大学DeepLIT课题组提出全新测试时课程合成框架TTCS,不依赖外部标注,通过生成器与求解器共进化博弈合成课程数据,解决测试样本过难导致的训练坍塌问题,实验显示其推理能力提升显著。

机器之心
推荐文章7

估值 16 亿美元的 AI 护士:Hippocratic AI 是全球护士短缺的解药吗?

Hippocratic AI 打造 AI Native 医疗劳动力平台,利用市场空白,研技术架构,交付优质对话体验。其商业模式依赖 AI Agent 主化,面临经济效益和竞争挑战,也有全球化护理需求等机遇。

海外独角兽
算法论文8

文生图Scaling新变量,被字节Seed团队发现了

ByteDance Seed团队研究发现,文生图模型中然语言Caption变长,不意味着模型获更多视觉监督,其信息量更能预测训练损失。团队提出Structured Prompt,从两侧提升文本条件,在多任务上取得显著提升。

机器之心
推荐文章8

RSI离我们有多远?这家中国团队给出了第一梯队的工程解

目前行业探讨大模型的RSI时,常陷入思维定势。EvoMap团队没有盲目跟风,而是提出极具现实意义的工程新路径,构建进化智能体,让经验在网络流转,还以硬核数据证明其体系有效性。

机器之心
算法论文7

LSTM之父22年前构想将成真?一周内AI「我进化」论文集中发布,新趋势涌现?

本文介绍AI模型我进化方向的进展,涉及多机构的相关论文。如受“哥德尔机”启发的“达尔文哥德尔机”可我改进;还有“我奖励训练”“MM - UPT”“UI - Genie”等方法,展现AI我进化潜力。

机器之心
算法论文8

DeepMind 颠覆机器人学习范式:让机器像人一样 “由成长”

谷歌DeepMind受大模型微调中强化学习阶段启发,提出面向机器人学的两阶段后训练方法,含监督微调与我提升。实验显示该方法让机器人主习得新技能、广泛泛化,但研究也存在标注成本高等局限。

AI科技评论
开源动态8

为训推加速!全新FlashQLA注意力算子库开源

Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。

千问大模型
新闻资讯8

“为了一个功能,需要再造一个Google!”Jeff Dean最新对话:TPU的诞生,与那些差点把服务器烧了的疯狂往事

在Google Cloud Next上,Jeff Dean和Amin Vahdat分享了Google算力帝国崛起秘史。从TPU诞生背景,到研硬件血泪史,再到软硬件协同设计,还探讨了AI未来瓶颈,如能源、硬件等,以及代码编写现状。

AI科技大本营
算法论文8

阿里新研究:统一了VLA和世界模型

阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。

量子位
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉大模型DINOv3,采用监督学习,无需标注数据。它在60多个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应多种部署环境。

AIGC开放社区