合成数学数据」共找到 2599 篇相关文章

产品应用8

信息:基于 JuiceFS 构建统一存储,支撑 PB 级 AI 训练

信息为应对AI训练存储挑战,引入JuiceFS构建统一存储架构,结BeeGFS作缓存。该架构提升I/O性能与资源调度效率,还通过缓存优化、数据治理等措施,支撑多业务并发,为AI基建奠基。

InfoQ
开源动态8

终结数据荒!智源开源首个Deep Research数据成框架InfoSeek

在大模型深度研究中,高质量数据是短板。近日,智源研究院发布首个面向深度研究的开源数据集InfoSeek,提出「扩散 - 回溯」数据成方法,用3B模型在基准测试中接近商业模型表现,且数据集可扩容。

新智元
算法论文7

SnapMoGen:44 小时动作数据 + 12 万文本注释,文本驱动动作生成数据集

近年来文本驱动动作生成有进展,但受限于数据集质量。Snap团队提出SnapMoGen数据集和MoMask++模型。前者有2万条动作片段和12.2万条文本描述,后者建模更有效,还结LLM提升适用性,但二者都有局限。

带你学AI
新闻资讯8

从 “管好数据” 到 “让数据生智”,华为再发新作《数据空间探索与实践》| 文末赠书

2025年11月15日,机械工业出版社牵头举办研讨会,庆祝《华为数据之道》发行五周年及《数据空间探索与实践》上市。行业大咖齐聚,共话数据治理演进,两书为行业提供了有价值的参考。

InfoQ
新闻资讯7

全国首部可信AI“技术安全+数据规”标准来了,欢迎参与起草!

2025年国家数据局开展可信数据空间试点,在多领域落地经验。但实践中技术、规等问题凸显。中国电子商会归口、智标准中心起草《人工智能大模型可信数据协作安全与规指南》,有诸多亮点,现公开征集起草单位和起草人。

AI工程化
新闻资讯7

全国首部可信AI“技术安全+数据规”标准来了,欢迎参与起草!

2025年国家数据局开展可信数据空间试点,在多领域落地经验。但实践中出现技术与标准等问题,中国电子商会归口、智标准中心组织起草《人工智能大模型可信数据协作安全与规指南》,介绍标准内容、亮点等并征集起草单位和起草人。

AI寒武纪
算法论文8

不靠海量数据,如何精准喂养大模型?上交Data Whisperer:免训练数据选择法,10%数据逼近全量效果

上海交通大学等团队提出 Data Whisperer,首个免训练的注意力驱动数据选择框架。它利用模型自身能力打分挑数据,无需训练与人工标注,用 10% 数据让微调效果逼近全量数据,在多方面领先传统方法。

机器之心
算法论文8

成数据≠生成模型:一文读懂成数据的全新范式

最新研究提出成数据全新分类框架,突破‘生成模型=成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出成数据面临模型坍塌等挑战,正成新型基础设施。

新智元
新闻资讯8

数据限制具身?觅蜂杀进场破局:高质量数据水电一样即取即用

2026年4月16日,觅蜂科技发布一站式物理AI数据服务平台等,董事长姚卯青称当前具身智能面临数据荒漠问题。觅蜂打造“又全又好又快”数据供给,还启动蜂巢数据共创行动,与多家企业作。

机器之心
算法论文8

ICML 2026 Oral | 为3D空间智能数据构建全自动数据飞轮,Holi-Spatial打造400万级空间多模态数据

来自多机构的研究团队提出 Holi - Spatial,可从原始视频自动生成 3D 重建等数据,构建 400 万级空间标注数据集 Holi - Spatial - 4M,提升 VLM 空间能力,还形成自动化数据飞轮,但存在计算成本高、特定场景表现不佳等局限。

机器之心
上一页1 / 260下一页