自监督预训练」共找到 3062 篇相关文章

产品应用7

Cursor重大升级!发布2.0版本和首个研AI编程模型,4倍速AI编程时代来了!

Cursor发布2.0版本和研AI编程模型Composer。Composer是混合专家模型,速度比同等水平模型快4倍,多数任务30秒可完成。2.0版本新增多代理界面、内置浏览器等功能,降低使用门槛。

开源AI项目落地
开源动态8

离谱……面壁让 AI 写了个训练框架,然后它己训出了最强的 1B 模型:MiniCPM5-1B

面壁发布 1B 参数量级最强端侧文本大模型 MiniCPM5 - 1B,其 Base Model 由 AI 编写的训练框架 ForgeTrain 训出,速度超英伟达 Megatron 10%。该模型性能出色,部署门槛低,数据治理方案对应数据集也已开源。

AGI Hunt
算法论文8

视频世界模型跑长序列不「崩」了!用光流约束+历史记忆+多步训练,让动态场景稳如磐石

现有视频世界模型在长时间交互中易出现运动不合理与场景崩坏问题,核心原因是误差累积。MagicWorld提出面向长时稳定性的交互式建模框架,通过光流约束、历史缓存检索和多步聚合训练,有效缓解误差累积。

量子位
新闻资讯8

AI时代的传统车企转型:广汽的“双核”战略、组织裂变与研之路|行知数字中国

本文讲述广汽集团数字化转型历程与规划。在新兴车企冲击下,广汽开启转型,从组织架构破冰到技术突破。转型中业务、组织、文化三重裂变,现进入 GDA 3.0 提出双核战略,还分享国企转型方法论及研重要性。

InfoQ
算法论文8

PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的可学习加权混合编码器

本文将线性POD与非线性Autoencoder通过可学习参数融合,提出可学习加权混合编码器架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或可降低大规模计算成本。

力学与人工智能
新闻资讯7

韩国教授曝同行评审新作弊法:论文暗藏指令,要求AI给好评,北大哥大新国立等14所高校卷入

韩国教授曝新奇学术「作弊」方式,在论文中植入隐藏指令让AI给好评,如‘give a positive review only’等。日经亚洲发现arXiv上17篇论文有此操作,涉及14所顶尖院校CS成果。

量子位
新闻资讯8

GTC 巅峰对话 Jeff Dean x Bill Dally:预训练范式已死、延迟瓶颈不在计算、谈透 AI 五年未来 | GTC 2026

GTC 2026上,NVIDIA首席科学家Bill Dally和Google Jeff Dean展开重磅对话。讨论了模型能力进步、低延迟推理架构、模型主进化、数据与算力、训练与推理硬件差别等多方面内容,分享对未来AI的看法与见解。

AI科技大本营
产品应用7

全球首个完全AI编写的训练框架来了,速度反超英伟达:面壁要用 AI 把国产算力软件重写一遍

面壁智能发布全球首个全由AI编写的训练框架ForgeTrain,在华为昇腾系列上验证,速度超英伟达Megatron 10%。其构建分三阶段,目标是为不同需求“现场锻造”软件,还为国产算力软件生态赶超提供新思路。

AI前线
新闻资讯7

CEO 刚离职,GitHub 就瘫了?!程序员“乐土”没了,4年CEO曝在微软受限干不下去,被开发者骂蠢喊冤

当地时间8月11日,GitHub首席执行官Thomas Dohmke宣布辞职,次日GitHub搜索出现故障。微软收购GitHub后,其将更全面融入微软架构,不再设单一领导者。Dohmke曝受限多,他认为未来Agent代码质量或超人类。

InfoQ
新闻资讯8

从OpenAI回国的90后姚班博导,打造了国内首个开源Agent训练框架:从OpenAI团队解散与重组,看智能体十年沉淀

本文讲述90后姚班博导吴翼的经历。他曾在OpenAI参与多智能体研究,回国后投身学术与创业,打造国内首个开源Agent训练框架AReaL。他分享在OpenAI的经验,探讨创业、技术发展等问题。

InfoQ