「语料规模」共找到 455 篇相关文章
75%预训练数据都能删!Jeff Dean新作:全自动筛除低质量数据
Google DeepMind团队开发的DataRater可全自动评估数据质量,用元学习筛选有价值数据,提升模型训练效率。它能减少计算量、提高性能,在低质量数据集效果佳,还能跨模型规模泛化。
公开模型一切,优于DeepSeek-R1,英伟达开源Llama-Nemotron家族
英伟达推出面向高效推理的 Llama-Nemotron 系列模型,包括 Nano、Super、Ultra 等规模,具备卓越推理能力与效率,采用开放许可。模型支持动态推理切换,训练结合多方法,性能优于 DeepSeek-R1 等。
太空算力竞赛白热化:谷歌刚刚发布计划,中国太空计算卫星星座已在轨运行半年
当地球AI算力竞赛内卷,太空算力赛道开启。中国国星宇航“星算”计划首批卫星半年前已组网运行,规模和算力世界第一。谷歌等巨头也有布局,但谷歌计划2027年初才发原型卫星,中国企业已占先发优势。
90% 应用已完成迁移!LinkedIn 宣布砍掉 Kafka,全面切换自研消息系统 Northguard!
领英宣布用自研消息系统 Northguard 取代 Kafka,还有虚拟化 Pub/Sub 层 Xinfra。Northguard 规模更大、架构优,Xinfra 能实现无缝迁移。超 90% 应用已完成迁移,领英还在考虑开源。
230个大模型在婴幼儿认知题上集体翻车!揭秘多模态大模型的核心知识缺陷
ICML 2025研究揭示多模态大模型在基础认知能力上表现不佳。研究者建测评题库CoreCognition测试230个主流模型,发现其存在核心知识缺陷,扩规模难补短板,还需补齐核心知识。
刚刚,英伟达向Ilya的公司砸下重金,算力要翻10倍
SSI官方宣布与英伟达达成长期战略合作,英伟达将大规模投资,助其12个月内算力扩10倍。此前SSI算力依赖谷歌TPU芯片,此次合作反映芯片厂商争夺客户策略。
Ilya罕见发声:大模型「大力出奇迹」到头了
Ilya大神在近2万字采访中称,AI正从「规模时代」走向「科研时代」,主流「预训练 + Scaling」路线遇瓶颈。他还探讨了AI泛化、安全对齐、预训练范式等热门话题,给出独特见解。
穿越100年前打造的AI,不知道二战和互联网,却从几个例子学会了Python
前OpenAI研究成员等打造出130亿参数的时代语言模型talkie,只用1930年前英文词元训练。它不知二战等现代信息,能从例子学Python,风格似20世纪绅士,研究团队将扩大其规模。
故障率降低100倍,微软突破性技术破解AI算力浪费大难题
在AI数据中心,网络链路高故障率制约算力释放。微软在“ACM SIGCOMM 2025”大会公布MOSAIC技术,将链路故障率降100倍,实现50米长距传输、最高68%功耗降低,为大规模AI集群提供支撑。
2026 中国 AGI 创新影响力机构 TOP 30 征集启动!
今年AI行业关注点重回模型与模型公司,开源逼近闭源前沿,C端用户规模上涨。在此环境下,极客公园启动2026中国AGI创新影响力机构TOP 30征集,从多维度评选,给出申报、评审及结果公布时间。