数据质量」共找到 2948 篇相关文章

推荐文章7

π0.6和GEN-1谁代表未来?乾坤未定,但这条底层赛道浮出水面

Generalist AI的GEN - 1引发行业关注,其创始人验证具身智能尺度定律。但很多公司在数据质量上遇困。智域基石提出‘数据编译’概念,构建五层编译管线,有独特商业模式,对未来数据路线持‘路线中立’观点。

机器之心
产品应用7

Legora、Mercor 都在用,Reducto 能成为独立的 LLM 数据入口吗?

当前企业AI落地瓶颈在数据质量,Reducto聚焦数据准确性,以文档解析API提供Agentic OCR能力。它获多轮融资,估值达6亿美元,但面临多模态模型竞争及定价等问题,其未来走向待察。

海外独角兽
产品应用8

今年最难的机器人Demo,“机器人含量”为0

自变量发布全新灵巧操作系统TwinDex,后训练阶段真机遥操数据为0,机器人就能完成多项精细操作。该系统设计有灵巧性、一致性和可扩展性,降低了对真机遥操数据的依赖,使高质量数据与真机遥操的强绑定松动。

量子位
开源动态8

超越VLA与世界模型,银河通用发布LDA,全谱系数据跑通Scaling Law

近期具身智能领域竞争激烈,银河通用联合多机构发布 LDA-1B 模型,能统一利用各类具身数据。它在基准测试中表现出色,代码已开源,还解决了数据格式、质量等问题,实战效果也很突出。

机器之心
产品应用8

腾讯云黄世飞:企业如何构建面向未来的 AI-Ready 智能数据基座

本文是腾讯云副总裁黄世飞在腾讯全球数字生态大会的分享,介绍腾讯云AI - Ready数据平台建设进展,涵盖背景挑战、架构创新、生态落地等内容,还提及相关应用实践及未来规划。

InfoQ
开源动态8

中山大学&华为联合提出 Issue Resolution 数据集构建神器SWE-Factory:每条只要$0.024

中山大学和华为联合提出低成本开源方案 SWE-Factory,可自动收集代码打造高质量代码评估数据集。它能解决传统构建流程繁琐、依赖人工的问题,实现全流程自动化,还构建了 SweSetupBench 数据集,表现出色。

深度学习自然语言处理
算法论文8

斯坦福与Adobe新研究,模仿蒸馏技术轻松让200亿参数图像生成高质量大模型

斯坦福大学和Adobe研究院联手,用pi - Flow技术让200亿参数文本到图像大模型4步内生成高质量、高多样性图片。此前少步生成有质量和多样性问题,他们推出GMFlow和pi - Flow解决难题,LakonLab是其背后工程支撑。

AIGC开放社区
产品应用7

数据分析师,即将从工业领域“消失”?

2023年底Google裁撤数据科学家引发关注,AI+BI普及使岗位裁撤风潮蔓延至工业领域。2025年7月TDengine发布TDengine IDMP,主打“无问智推”,有望带来数据消费范式革命,加速工业智能化转型。

InfoQ
新闻资讯7

又一家清华系具身智能企业浮出水面:天使轮融资数千万元,打造具身数据Infra丨甲子光年

清华系具身智能企业灵御智能完成数千万元天使轮融资,累计融资近亿元。其聚焦打造具身数据Infra,研发TeleAvatar和TeleDroid构建数据采集母机,锁定三类应用场景,还从两方面压缩成本。

甲子光年
开源动态8

500万视频数据集+全新评测框架!北大开源主体一致性视频生成领域新基建OpenS2V-Nexus,生成视频 「像」 又 「自然」

北大团队推出开源套件OpenS2V - Nexus,含全球首个S2V细粒度评测基准OpenS2V - Eval和500万条高质量人物文本视频三元组数据集OpenS2V - 5M,还评测18个S2V模型,揭示主流模型能力差距。

机器之心