「《华为数据之道》」共找到 2667 篇相关文章
Legora、Mercor 都在用,Reducto 能成为独立的 LLM 数据入口吗?
当前企业AI落地瓶颈在数据质量,Reducto聚焦数据准确性,以文档解析API提供Agentic OCR能力。它获多轮融资,估值达6亿美元,但面临多模态模型竞争及定价等问题,其未来走向待察。
科研数据不再碎片化!一张可计算图,连起整个科研世界
UIUC研究团队打造ResearchArcade,将ArXiv论文、OpenReview评审等碎片数据连接成动态知识图谱。它有多源、多模态等特征,支持多种格式数据导入导出,定义了六个任务,验证了图结构在科研数据处理中的作用。
华为发布全新芯片之后,国产AI芯片面对的三个关键问题
华为在2025全连接大会发布多款AI芯片并公布路线图,其“P/D分离”设计针对市场挑战。文章指出中国AI产业需求倒逼芯片创新,还分析了国产芯片面临的生态、产品经理人才及产业与芯片关系等问题。
超越VLA与世界模型,银河通用发布LDA,全谱系数据跑通Scaling Law
近期具身智能领域竞争激烈,银河通用联合多机构发布 LDA-1B 模型,能统一利用各类具身数据。它在基准测试中表现出色,代码已开源,还解决了数据格式、质量等问题,实战效果也很突出。
We-Math 2.0:全新多模态数学推理数据集 × 首个综合数学知识体系
北京邮电大学、腾讯微信、清华大学团队提出We - Math 2.0,含知识体系、数据集及训练策略,可提升模型数学推理泛化能力。该成果在X上获关注,登Huggingface Paper日榜第一。
华人团队终结Token危机:扩散模型数据潜力超自回归三倍
最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。
国产LLM又迎来一波开源潮:Qwen、华为盘古、腾讯混元、小米~
本周国产开源LLM集中爆发,Qwen、华为盘古、腾讯混元、小米等接连发布模型。如Qwen3 - 4B性能提升,Qwen - Image文生图能力强;华为开源盘古模型并宣布CANN开源;腾讯混元小尺寸模型特点多且已落地业务。
刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA
普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。
华为CloudMatrix重磅论文披露AI数据中心新范式,推理效率超NV H100
华为发布60页重磅论文,提出下一代AI数据中心架构Huawei CloudMatrix及产品CloudMatrix384。它架构设计独特,性能高效准确灵活,打破算力、延迟和成本“不可能三角”,重新定义AI基础设施。
腾讯云黄世飞:企业如何构建面向未来的 AI-Ready 智能数据基座
本文是腾讯云副总裁黄世飞在腾讯全球数字生态大会的分享,介绍腾讯云AI - Ready数据平台建设进展,涵盖背景挑战、架构创新、生态落地等内容,还提及相关应用实践及未来规划。