数据获取」共找到 2583 篇相关文章

新闻资讯7

机器人的 GPT 时刻比我们以为的更近|AGIX PM Notes

文章认为机器人的 GPT 时刻可能比想象更近,未来 2 - 3 年或出现较通用机器人,3 - 5 年有望规模化部署。还分析了当前机器人发展情况、瓶颈及数据获取方式,同时介绍了上周市场动态和多家公司的 AI 相关事件。

海外独角兽
新闻资讯7

「一脑多形」圆桌:世界模型、空间智能在具身智能出现了哪些具体进展?|GAIR 2025

在第八届GAIR全球人工智能与机器人大会“数据&一脑多形”分论坛的圆桌论坛上,高飞、金鑫、王靖博三位学者围绕具身智能、空间智能、世界模型等话题展开讨论,探讨研究进展、挑战与机遇,还谈及创业和数据获取等问题。

AI科技评论
算法论文8

字节最新大模型秘籍:只挑能有推理潜力的数据训练!1.3B模型无需标签自动挑选

字节Seed团队发布AttentionInfluence成果,用1.3B模型给7B模型选数据,无需训练和标签。通过比较基础与弱化模型损失差异评估数据影响,在多基准测试提升模型性能,还能结合分类器全面提升表现。

量子位
算法论文8

刘鹏飞组提出Agent领域的少即是多:智能不在于数据堆砌,78个样本训练出超强Agent,128倍效率提升

刘鹏飞组论文《LIMI: Less is More for Agency》提出颠覆性观点,认为Agent智能培育关键在数据质而非量。LIMI用78个样本在AgencyBench得分超基线模型,实现128倍数据效率提升,为Agent开发提供新路径。

深度学习自然语言处理
开源动态8

500万视频数据集+全新评测框架!北大开源主体一致性视频生成领域新基建OpenS2V-Nexus,生成视频 「像」 又 「自然」

北大团队推出开源套件OpenS2V - Nexus,含全球首个S2V细粒度评测基准OpenS2V - Eval和500万条高质量人物文本视频三元组数据集OpenS2V - 5M,还评测18个S2V模型,揭示主流模型能力差距。

机器之心
算法论文8

北大团队让AI学会考古!全球首个古希腊陶罐3D视觉问答数据集发布,还配了专用模型

北大团队推出全球首个面向古希腊陶罐的3D视觉问答数据集VaseVQA - 3D,配套专用视觉语言模型VaseVLM。传统模型面对文化遗产复杂对象有不足,新数据集和模型让AI迈向‘文化考古Agent’,未来将拓展到更多领域。

量子位
开源动态7

Ultralytics & lightly-train:简化计算机视觉模型训练,无需标签

在计算机视觉领域,获取带标签数据成本高、耗时长。开源项目 lightly-train 用未标记图像和视频自监督预训练,减少标注成本与时间,可集成到现有训练管道,支持多种模型架构和应用场景。

机器学习AI算法工程
产品应用8

全自研仿真GPU求解器x虚实对标物理测量工厂,打造具身合成数据SuperApp,加速具身仿真生态丨光轮智能@MEET2026

在量子位MEET2026大会上,光轮智能杨海波指出具身智能核心是数据,仿真是解决数据问题的唯一方案。光轮智能自研“测量、生成、求解”基础设施,建立全栈仿真平台,还打造多个“爆品应用”,为具身智能发展提供支撑。

量子位
产品应用7

Gemini盘活了谷歌全家桶,“原生”自带你10年的记忆

谷歌发布由Gemini3驱动的“Personal Intelligence”功能,底层连接旗下四大应用,让AI跨应用获取数据,还内置纠错机制。该功能现处Beta测试,未来覆盖免费用户。谷歌与苹果引入Gemini后路径不同,AI竞争也转向生态构建。

量子位
算法论文8

数据邪修大法好:仅用文本数据就能预训练多模态大模型

多模态大模型研发中,行业认为无图文对就无多模态能力。但ReVision研究表明,预训练阶段昂贵配对关系非必需,利用非配对数据统计信息修正文本表征,能实现跨模态互换,降低成本。

量子位