自监督模型」共找到 8319 篇相关文章

算法论文7

LSTM之父22年前构想将成真?一周内AI「我进化」论文集中发布,新趋势涌现?

本文介绍AI模型我进化方向的进展,涉及多机构的相关论文。如受“哥德尔机”启发的“达尔文哥德尔机”可我改进;还有“我奖励训练”“MM - UPT”“UI - Genie”等方法,展现AI我进化潜力。

机器之心
算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做体检?

随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
开源动态8

为训推加速!全新FlashQLA注意力算子库开源

Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。

千问大模型
算法论文8

北大、字节、中科院动化研究所等提出图像并行生成新范式

北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。

AIGC开放社区
新闻资讯8

4000 万美金新一轮融资,ACE 成为 AI 音乐赛道融资额最高的华人团队

近日,AI音乐公司ACE完成近4000万美元新一轮融资,成AI音乐赛道融资额最高的华人团队。它己训练音乐基础模型与做应用,构建数据飞轮,还推出新消费级产品Miya,欲打造AI时代的Spotify。

Founder Park
开源动态7

小红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?

小红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以小红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。

InfoQ
新闻资讯8

英伟达毁CUDA门槛!15行Python写GPU内核,性能匹敌200行C++

英伟达发布CUDA 13.1,称是2006年诞生以来最大进步。推出CUDA Tile编程模型,能用15行Python代码实现200行CUDA C++代码性能。芯片界传奇Jim Keller质疑其会终结CUDA“护城河”。

量子位
算法论文8

刚刚,何恺明团队新作,「嵌入式语言流」ELF来了

何恺明团队提出ELF模型,将扩散过程置于连续向量空间,只在最后翻译成词。它用一个网络实现去噪和解码,引入条件机制。实验显示,ELF用不到其他方法十分之一数据,生成质量全面领先。

机器之心
开源动态8

你的电子老婆开源了!登顶GitHub热榜

GitHub热榜项目AIRI是超火虚拟主播Neuro - sama的开源版,可托管,7×24小时在线。它能实时语音、陪玩游戏等,支持多种大模型API,还介绍了不同系统搭建该项目的方法。

量子位
开源动态8

3D指标超过Nano Banana Pro!浙大开源方案让AI在平面图像里进行立体编辑 | ACM MM'26

当前图像编辑模型处理三维状态常出错。浙江大学ReLER团队提出并开源PhyEdit,用显式3D几何preview指导图像编辑,还加入深度监督,构建数据集和评测基准,成绩超Nano Banana Pro,且GUI也开源。

量子位