大规模数据」共找到 6816 篇相关文章

新闻资讯7

人才黑洞!UC伯克利系主任都加入A社了

UC伯克利EECS系主任Jelani Nelson暂离学,加盟Anthropic预训练团队。他算法课播放量超2100万,研究聚焦大规模数据高效处理,这正是A社所需,此前他还在谷歌兼职。

量子位
开源动态8

模型开发者必读!拆解世界级AI模型的诞生,Hugging Face把4年模型训练经验写成了一本开源指南

Hugging Face发布《The Smol Training Playbook》,分享约4年构建SOTA模型和数据集的经验。手册涵盖是否训练、训练何种模型、如何训练等内容,强调数据质量重要性,还介绍了模型设计、训练中的实践与教训。

AIGC开放社区
新闻资讯8

我在WAIC看见的十趋势

上海世界人工智能会(WAIC)热度空前,一票难求。本文总结了WAIC呈现的十核心趋势,如中国AI因DeepSeek而不同,开源模型进入中国时间,AI创新来到ToC阶段,第一批商业化AI终端是汽车、耳机和眼镜等。

量子位
开源动态8

4B小模型数学推理首超Claude 4,700步RL训练逼近235B性能 | 港&字节Seed&复旦

香港学NLP团队联合字节跳动Seed、复旦学发布Polaris强化学习训练配方,让4B模型数学推理能力超商业模型,且Polaris-4B可在消费级显卡部署,相关内容已全部开源。

量子位
产品应用8

The Batch: 968 | Muse Code 想获取你的数据

Meta推出Muse Code编码框架及Muse Spark 1.2模型,有不同输入输出、功能和性能表现。提供不同档位价格,贡献者档位低价但数据用于训练。测试显示其单任务成本低,Meta此举或为获取编码训练数据

DeeplearningAI
开源动态8

社区供稿丨MiniCPM-V 4.5 技术报告正式出炉

上个月开源的多模态模型 MiniCPM-V 4.5 广受好评,今日其技术报告出炉。报告从架构、数据和训练三方面探索高效路径,提出三技术,使模型在多任务上突破,小参数规模下性能和推理速度佳。

Hugging Face
推荐文章7

李静海院士团队:未来数据系统的逻辑与架构 | Engineering

本文展望数据科学未来,强调其对AI重要性。探讨科学数据系统挑战,提出收集处理原则,指出要重视数据系统逻辑与架构研究,建立标准协议框架,促进AI健康发展。

力学与人工智能
新闻资讯7

《AI模型与异构算力融合技术白皮书》10月10日发布

算泥社区《AI模型与异构算力融合技术白皮书》10月10日14:00线上发布。AI模型爆发使算力需求激增,异构算力成刚需。国内外政策与产业驱动其发展,该白皮书能为开发者提供实用技术参考。

AIGC开放社区
新闻资讯7

全球开源模型,前十五名全是中国的

近日,随着新一代语言模型更新,开源模型成热门话题。Design Arena排行榜上,若设定为“开源”,前15名均为国产开源模型,排名第一的是DeepSeek - R1 - 0528 ,智谱、阿里等厂商多款模型上榜。

机器之心
算法论文7

AI 的“思维链”推理是海市蜃楼吗?

亚利桑那州立学论文《语言模型的思维链推理是海市蜃楼吗?》认为思维链推理在数据分布偏移时易出错,可能只是对训练数据模式的记忆。作者 Sean Goedecke 认为该论文结论不合理,从推理与语言、模型规模等方面提出反对意见。

宝玉AI