大规模数据」共找到 6816 篇相关文章

开源动态8

全球首个!10万小时人类数据全开源,Hugging Face罕见站台

上周Dyna Robotics公司用超100万小时人类第一视角视频训练DYNA - 2模型,发现物理AI有Scaling Law。8月20日光轮智能宣布10万小时全模态人类行为数据EgoSuite - Open100K开源,与Hugging Face联合发布。

新智元
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

模型浪潮下,企业对AI投入加,私有化部署需求凸显,但缺乏成熟实施框架。全国首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》应运而生,已聚集30余家单位参编。

AI工程化
算法论文8

NeurIPS 2025 | 告别全量扫描!浙提出COIDO:破解多模态数据选择「高耗」难题

提出 COIDO 框架解决多模态数据选择「高耗」难题。它摒弃全量扫描,用轻量级评分器和小样本采样,将重要性和多样性的优化统一。实验显示,它性能与效率双优且有强泛化性。

机器之心
算法论文8

ICML 2025 | 模型能在信息不完备的情况下问出正确的问题吗?

当前语言模型推理研究多聚焦被动推理,主动推理研究少,制约其在现实场景应用。为此提出 AR - Bench 基准评估模型主动推理能力,实验显示模型主动推理能力严重不足,并指出后续拓展方向。

机器之心
算法论文7

Fable5仅做对3.5%!模型会看图,但还没有主动视觉

本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。

机器之心
推荐文章7

人手数据,如何重塑机器人基础模型?专访 LaST-HD 一作刘家铭

本文是对 LaST-HD 一作刘家铭的专访。围绕数据路线之争,刘家铭分享交付背后的技术问题,也谈了对具身领域模型与数据发展方向的判断。他认为 Human Data 与真机数据非替代关系,VLA 和世界模型可共存。

AI科技评论
产品应用8

Pinecone 推出 Nexus 引擎:为 AI 智能体整合业务上下文并生成结构化数据

Pinecone Nexus 全面上线,是面向 AI 智能体的“知识引擎”,能将企业数据转为结构化数据层,复用数据提准确性、降成本。早期采用者在金融、法律领域看到显著性能提升,词元消耗幅降低。

InfoQ
推荐文章8

概是我读过关于AI模型最全面、好读又易懂的文章了

文章从神经网络入手,介绍其概念、学习过程,进而引出语言模型,阐述其原理、训练方法,还提及AI浪潮下基础设施及模型使用方式,如Agent、MCP等,展现神经网络和模型发展现状与前景。

腾讯技术工程
新闻资讯8

4位图灵奖得主布道,2冠军机器人登台,“AI春晚”果然又高又硬

智源会堪称“AI春晚”,规格高看点多。4位图灵奖得主分享观点,长跑冠军天工和拳击冠军宇树G1机器人秀技能。会还发布“悟界”系列模型,RoboOS 2.0与RoboBrain 2.0开源,多方探讨下一代AI发展路径。

量子位
新闻资讯8

具身数据来了实战派!40天2轮融资数千万,瞄准物理AI基础设施

近日,具身智能数据基础设施公司元点科技完成数千万元融资。其创始人郭江亮认为具身智能竞争进入下半场,本质是数据竞争。元点用MatrixOS构建数据基础设施,业务与生态全面铺开,团队实力强,瞄准2027 - 2029窗口期。

量子位