大规模数据」共找到 6816 篇相关文章

开源动态8

开源多模态推理「破壁」时刻:MMFineReason助力4B逆袭30B

长期以来,开源多模态模型在复杂推理任务上与顶尖闭源模型有差距,核心痛点是高质量推理数据匮乏。上海AI实验室OpenDataLab团队开源MMFineReason框架及大规模数据集,小模型凭此实现性能逆袭。

机器之心
开源动态8

360开源高质量图文对齐数据集!收纳1200万张图像+1000万组细粒度负样本,让模型告别“图文不符”

360人工智能研究团队的冷炜博士团队开源FineHARD高质量图文对齐数据集,包含1200万张图像、4000万个边界框及对应描述、1000万组细粒度难负样本,能提升模型图文对齐能力,还介绍了构建方法、分析及应用前景。

量子位
新闻资讯8

王小川:医疗行业对模型有三刚性要求,但通用模型一条都不达标

5月22日百川智能展示医疗模型Baichuan - M4与AI家庭医生「百小医」。王小川指出通用模型用于医疗有问题,医疗对模型有低幻觉、强循证、会提问的刚性要求,而通用模型不达标。Baichuan - M4表现出色,百小医也有独特定位和优势,且与三家顶尖医院合作成果显著。

Founder Park
新闻资讯7

甲骨文副总裁吴承杨:AI 放数据优势,数据融合至关重要

甲骨文公司副总裁吴承杨称AI放数据优势,多模融合数据库至关重要。中国区技术咨询部高级总监嵇小峰表示企业构建Agent AI要关注数据访问需求和安全。Oracle用一体化架构解决融合问题,还介绍了相关技术及应用。

AI前线
新闻资讯7

《AI模型与异构算力融合技术白皮书》正式发布

10月10日,中科算网等联合发布《AI模型与异构算力融合技术白皮书》,聚焦模型开发痛点,为开发者提供技术参考。白皮书介绍全球模型发展概况、应用场景拓展、算力需求与挑战,指出异构算力成主流趋势。

AIGC开放社区
开源动态8

联手字节:开源规模指令跟随视频编辑数据集OpenVE-3M

浙江学与字节跳动合作,提出规模指令跟随视频编辑数据集 OpenVE-3M,有 3M 样本对。还提出数据构造管线、编辑模型 OpenVE-Edit 及评测集 OpenVE-Bench,小参数量下超越现有开源模型。

机器之心
新闻资讯7

全国首部“数据流通交易合规”标准,现公开征集起草单位和专家!

2026年是数据要素价值释放年,数据资产交易却面临合规与安全难题。中国电子商会归口、智合标准中心组织编制《企业数据要素流通交易合规指南》团体标准,涵盖多核心模块,有三亮点,现征集起草单位和专家。

AI工程化
新闻资讯8

微软分享三王炸算法:突破模型推理瓶颈,性能

今天凌晨微软官网分享三创新算法,即rStar - Math、LIPS、CPL,可助模型突破推理瓶颈,增强数学推理和思考链能力,还介绍了各算法原理、优势及对应论文地址。

AIGC开放社区
开源动态8

不用千亿参数也能合成高质量数据!这个开源框架让小模型“组团逆袭”,7B性能直追72B

上海人工智能实验室与中国人民学提出GRA框架,以“多人协作”理念让小模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对模型蒸馏依赖,展现“集体智能”潜力。

量子位
新闻资讯8

振臂一挥,半个具身机器人圈都来了!智源研究院:别藏了,谁贡献数据多,谁的脑就更好用

2025智源具身智能Open Day上,智源研究院院长邀厂商共享数据,称谁家贡献多,具身脑在其机器人上更好用。智源无商业包袱,开源数据、统一评测,布局具身小脑体系,欲做具身智能“安卓”。

量子位