自监督预训练」共找到 3068 篇相关文章

开源动态8

阿里开源DeepResearch模型,超强“AI研究员”,开启主智能体新纪元

阿里巴巴通义实验室开源Tongyi DeepResearch模型,是全球首个性能能与OpenAI DeepResearch较量且全开源的Web Agent。它采用先进架构,有两套推理范式,训练方法论有创新,实测表现佳,应用场景广,用Apache - 2.0许可证。

AIGC开放社区
新闻资讯8

梁文锋执笔的R1论文登上Nature封面!首次回应外界三大质疑

9月17日,DeepSeek创始人梁文锋通讯作者名义发表的DeepSeek - R1论文登《然》封面。该模型借助强化学习主形成推理能力,在Hugging Face下载量破1090万次。新版论文回应质疑,披露训练细节,虽有不足但引发学界关注。

InfoQ
新闻资讯7

英伟达的局:狂撒15亿美元,从Lambda那租到了搭载家AI芯片的GPU服务器

据The Information消息,英伟达与小型云服务提供商Lambda达成15亿美元合作,租赁其搭载研AI芯片的GPU服务器。这并非首次,此前已对CoreWeave如此操作。目的是维护其在云计算市场的主导地位。

机器之心
新闻资讯8

Anthropic 完成930亿元 F 轮融资,投后估值达 13096亿

Anthropic 宣布完成由 ICONIQ 领投的 130 亿美元 F 轮融资,投后估值达 1830 亿美元。众多顶级投资机构参与,推出 Claude 模型后增长飞速,业务覆盖多领域,资金将用于扩产、安全研究和国际化。

AI寒武纪
开源动态8

超越O4-mini,多模态大模型终于学会回头「看」:中科院动化所提出GThinker模型

现有多模态大模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源。

机器之心
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁大模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强大泛化能力。

量子位
新闻资讯7

小米的中国芯,与雷军没说的“四个秘密”

本文围绕小米玄戒芯片展开,介绍其推出背景、工艺选择、研发成本及应用前景。指出华为、OPPO调整业务给小米带来契机,3nm工艺因品牌与成本平衡成首选,还分析了研成本和知识产权等挑战。

芯师爷
新闻资讯8

OpenAI曝出第一颗芯片叫「辣椒」!AI己设计,9个月流片

OpenAI首颗研芯片Jalapeño问世,9个月从白纸到流片,创行业最快纪录。该芯片专为大模型推理设计,由其AI参与设计优化,有望降低推理成本,提升用户体验。OpenAI欲做全栈AI公司。

新智元
推荐文章8

推荐系统进入“大模型时刻”:昇腾NPU如何支撑千亿级生成式推荐落地

文章基于华为郭威在2025 AICon大会演讲,复盘华为推荐技术探索。介绍FuXi-α、β模型设计,解决训练和推理难题;分享“多阶段统一建模”进展,提出Performance Law;还介绍了训推系统优化及未来聚焦“强算力”“强模型”融合。

InfoQ
产品应用7

WorkBuddy杀疯了?一群AI专家帮我打工,我在微信里当赛博虾工头!

本文介绍腾讯推出的全场景职场AI智能体桌面工作台WorkBuddy。它内置多领域垂类专家,能接管媒体内容创作流水线,还接入微信ClawBot插件方便操作。部署和技能配置门槛低,内置主流模型,还有免费Credits福利。

量子位