具身数据Infra」共找到 3234 篇相关文章

推荐文章7

当AI吞噬软件,数据正在成为企业唯一的护城河

随AI火热,全球数据基础设施市场经历范式转移。算法与算力日趋同质,数据成企业竞争力护城河。多数企业数据体系未就绪,传统架构有障碍。文章提出AI原生数据平台的设计原则,云器科技等厂商正沿此方向发展。

InfoQ
算法论文8

清华刘知远团队:高质量LLM训练数据获取新方法!成本降90%,性能大提升

清华刘知远团队论文提出全新数据筛选方案,解决传统数据筛选验证慢、主观性强问题。发明‘半成品加工法’降成本,用fastText筛数据,筛出Ultra - FineWeb数据集,提升模型性能,还计划拓展到专业领域。

深度学习自然语言处理
新闻资讯8

独家解读|2025年AI五大趋势与底层数据革命

2025 年 AI 发展重心转移,高质量数据成新基石。本文解读五大技术趋势,如多语种 TTS 与全双工交互、多模态大模型等,还介绍了各趋势的数据需求及数据堂提供的相应数据服务方案。

机器之心
开源动态8

全球首个!10万小时人类数据全开源,Hugging Face罕见站台

上周Dyna Robotics公司用超100万小时人类第一视角视频训练DYNA - 2模型,发现物理AI有Scaling Law。8月20日光轮智能宣布10万小时全模态人类行为数据EgoSuite - Open100K开源,与Hugging Face联合发布。

新智元
算法论文8

ICCV2025 | One image is all you need,多模态指令数据合成,你只管给图,剩下的交给Oasis

近年来多模态指令数据合成依赖人工设计提示词,成本高。本文提出 Oasis 方法,仅靠图像生成数据,打破传统输入模式,还开源代码库 MM - INF。实验显示其数据多样,能提升 MLLM 性能。

机器之心
新闻资讯7

告别传统存算分离,AI时代数据底座迎来全新底层逻辑

文章围绕AI时代数据底座变革展开。指出传统大数据平台难适配AI,存在数据够不着、模型用不好等问题。阐述AI时代基础设施变化,如数据形态、计算模式等。还探讨底座升级条件、存储挑战、算子价值及未来标准层等内容。

AI前线
新闻资讯8

当机器人学会「看」和「说」之后,如何让它们真正拥有「手感」?

今年四月,戴盟机器人联合多家机构发布含触觉全模态数据集 Daimon-Infinity 并开源 10000 小时数据。IEEE 与戴盟联合创始人王煜教授深度对话,探讨触觉感知对机器人技术格局的影响、身机器人落地场景等问题。

AI科技评论
开源动态8

40.9K Star 数据可视化神器!Json数据处理领域的“瑞士军刀”!

数据驱动场景中,解析复杂嵌套JSON结构费时费力。GitHub上标星40.9K的开源工JSONCrack,能将JSON数据可视化为交互式节点图,还有转换、格式化等功能,使用简单,应用场景广。

开源星探
算法论文8

柔体操作最缺数据、最怕仿真失真?新研究让布料物理真实再现

上海AI Lab的SIM1研究实现布料物理性质真实再现,解决仿真数据与真实场景对齐问题。它提出real - to - sim - to - real新范式,通过闭环流程生成数据,能扩展轨迹、提升泛化能力,有望重新定义机器人数据天花板。

量子位
新闻资讯7

立足影视文化产业,联动科技,超前布局,推动建设北京视听数据可信空间!首创郎园这样为企业服务——

在2025中国广播电视精品创作大会期间,‘中国视听数据资产化主题研讨’活动举办,‘北京视听数据可信空间’启动建设。该空间是全国首个聚焦大视听产业的可信数据空间,为视听产业数据要素市场化配置助力。

郎园Station