大模型数据」共找到 9982 篇相关文章

开源动态7

从社区数据出发,再看模型开源开发生态全景与趋势

蚂蚁开源先后在527蚂蚁技术日和外滩会发布模型开发生态开源项目全景图1.0和2.0版本。2.0版更新评估方法,呈现生态新变化,还分析技术趋势、开发者分布,提及项目进出情况及TensorFlow衰落等。

InfoQ
算法论文7

函数向量对齐技术,让模型持续学习不“失忆”丨ICLR 2025

中国科学技术学等校团队破解语言模型灾难性遗忘之谜,发现遗忘源于模型激活带偏差新功能,非覆盖旧功能。还设计FVG训练法,保留并对齐函数向量,保护模型能力。相关论文被ICLR2025接收,代码开源。

量子位
开源动态8

震撼发布!最人体动作数据集 MotionMillion 正式登场

上海交通学研究团队构建高效标注流程,发布最人体动作数据集MotionMillion,含超2000小时、200万条文本 - 动作配对数据。还推出评测体系MotionMillion - Eval,训练70亿参数动作生成模型,刷新SOTA。

带你学AI
新闻资讯7

模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%

Transformer作者初创公司Sakana AI公布AI解决数独能力排行榜,用全新基准Sudoku - Bench考验模型创造性推理能力。结果显示模型总体正确率仅15%,9×9数独中高性能模型o3 Mini High正确率2.9%。

量子位
开源动态8

工业级 LLM 数据工程:北京学 DCAI 团队 DataFlow 框架的架构设计与实践

2026 年模型研发从‘模型中心’向‘数据中心’演进,数据语义密度与工程精度成突破关键。北京学 DCAI 团队推出 DataFlow 框架,解决数据准备难题,其技术报告登顶 Hugging Face。该框架有多种特性,实验验证其能提升模型性能。

InfoQ
新闻资讯8

人形机器人交付元年,行业从卷模型转向拼数据

2026年是具身智能交付元年,行业从卷模型转向拼数据。全球权威机构重新定义“人形机器人数据”地位,真机数据模型落地关键。乐聚等企业积极布局,通过训练场模式获取数据,解决行业痛点。

DeepTech深科技
开源动态8

开源即爆火!英伟达重磅推出OmniVinci全模态模型

英伟达在华盛顿GTC会开源OmniVinci全模态语言模型,实现视觉、音频、语言统一理解。它性能超竞品,架构有创新,数据引擎庞。实验有重要洞察,在多场景表现佳,代表全新AI范式。

机器之心
算法论文8

多模态模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26

多模态模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北和山团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。

新智元
新闻资讯7

刚刚,智谱正式成“全球模型第一股”,开盘涨超3%!10位董事7个清华背景,专家:国内IPO抢收“确定性”,OpenAI们豪赌“无限性”

今天,智谱在港交所正式挂牌上市,成“全球模型第一股”。其有技术、产品、商业化等竞争力,但未盈利,研发投入。专家认为国内模型厂商上市是抢收确定性,而OpenAI等是扩展无限性。

InfoQ
算法论文8

模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion

上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。

量子位