大数据自治」共找到 6662 篇相关文章

新闻资讯7

重磅团队领衔,国内首部人工智能软硬件跨境数据标准启动编制!

随着AI技术发展,智能软硬件跨境数据流动频繁,数据合规问题凸显。国内首部《人工智能软硬件跨境数据合规指南》团体标准启动编制,以厂经验为蓝本,提供可落地方案,解决实操难题。

AI工程化
产品应用7

揭秘 Uber 跨区域数据湖与灾难恢复机制:350PB 数据、数百万事件、单一系统

Uber构建的HiveSync是分片式批量复制系统,能让Hive和HDFS数据跨区域同步,每天处理数百万Hive事件。它基于Airbnb ReAir扩展,分离控制与数据平面,有复制和数据修复两组件,未来计划拓展到云端。

InfoQ
新闻资讯8

全球首个真实世界具身多模态数据集,它石智航交卷,比特斯拉还早6个月

它石智航发布全球首个规模真实世界具身VLTA多模态数据集WIYH,将于2025年12月开放。该数据集突破,特点鲜明,优势明显,其发布填补数据空白,奠定以人为本范式。

量子位
新闻资讯8

真正面向模型的AI Infra,必须同时懂模型、系统、产业|商汤装置宣善明@MEET2026

商汤装置副总裁宣善明在MEET2026会分享进展,强调模型时代AI Infra要解决算力高效支撑问题。商汤战略“1+X”,装置有优势,算电协同成果好,还推动国产化适配,产业落地成果多。

量子位
算法论文7

SnapMoGen:44 小时动作数据 + 12 万文本注释,文本驱动动作生成数据

近年来文本驱动动作生成有进展,但受限于数据集质量。Snap团队提出SnapMoGen数据集和MoMask++模型。前者有2万条动作片段和12.2万条文本描述,后者建模更有效,还结合LLM提升适用性,但二者都有局限。

带你学AI
推荐文章7

数据合成有没有未来?事实结论来了

有人认为用模型合成数据可快速生产,无需人工标注。但作者观察发现人工标注不仅必要且要求更高。以Scale AI、Surge AI为例说明标注价值,还展示‘智能知识’团队对两数据集审查结果,证明高质量数据需专家和管理流程。

AI工程化
产品应用8

GenAI 退烧后,这家企业正在用 “数据平台” 重构AI2B的底层逻辑

GenAI浪潮下,企业级AI落地难。矩阵起源举办新品发布会,其CEO王龙指出落地瓶颈已从模型转向私域数据。该司推出MatrixOne和MatrixOne Intelligence,构建“数据智能飞轮”,MOI三层架构可打通数据到业务落地流程,还通过案例展现其解决实际痛点能力。

InfoQ
产品应用7

甲骨文副总裁吴承杨:AI 放数据优势,数据融合至关重要

甲骨文公司副总裁吴承杨认为 AI 放数据优势,多模融合数据库至关重要。对比传统开源数据库,Oracle 能精简编排步骤。嵇小峰指出企业构建 Agent AI 要关注数据需求和安全。

InfoQ
新闻资讯8

全球首家具身数据独角兽诞生:光轮智能完成10亿元融资,开启具身数据规模化元年|甲子光年

具身智能进入数据Scaling Law时代,光轮智能完成10亿融资成全球首家具身数据独角兽。它构建了World-Behavior-Eval数据引擎体系,在多领域获国际交付冠军,客户涵盖顶尖企业,正构建物理AI时代基础设施。

甲子光年
算法论文8

JCP | 南科赵肃楠、王建春等:LESnets:基于物理信息神经算子的湍流涡模拟

本研究提出基于物理信息神经算子的LESnets方法,用于快速模拟粗网格上三维湍流时空演化。不使用标签数据,训练两种神经算子,验证了其有效性和泛化能力,效率显著优于传统方法。

力学与人工智能