「开源数据」共找到 4884 篇相关文章
Dexmal原力灵机开源Dexbotic,基于PyTorch的一站式VLA代码库
Dexmal原力灵机推出基于PyTorch的开源视觉-语言-动作模型(VLA)代码库Dexbotic,面向具身智能研究者。其架构含三大核心组件,有五大特征,还推出开源硬件,未来将持续投入生态建设。
不平衡数据下对比学习的理论分析:从训练动态到剪枝解决方案
本文第一作者为新泽西理工学院廖海旭。对比学习在类别不平衡数据下面临挑战,此前研究未考虑其影响。本文构建理论框架刻画训练动态,定量分析少数特征影响,提出剪枝算法增强少数特征学习,实验验证其有效性。
碾压DeepSeek V3!阿里开源新版Qwen-3,屠榜级断层第一
今天凌晨1点,阿里巴巴开源Qwen3系列新版本Qwen3 - 235B - A22B - 2507。它是非思维推理的指令微调模型,性能强劲,在多类测试基准中大幅超DeepSeek开源的新版V3 - 0324及月之暗面的kimi - k2。
Google Research 开源新架构,AI 不再依赖云端,直接跑在手表和耳机上
Google Research 开源 Coral NPU 平台,是面向硬件工程师与 AI 开发者的全栈开源方案,可克服 AI 在可穿戴和边缘设备落地的瓶颈,实现能耗与算力平衡,还能解决算力、生态、隐私等问题。
告别先开发后治理:Agent 驱动的数据质量一体化交付
文章指出离线数据开发中数据质量建设面临开发与治理分离的困境,如治理滞后、迭代不同步等。DataWorks引入Data Contracts理念,以YAML Spec形式将质量规则嵌入开发流程,还可借助Agent配置规则,未来将多引擎覆盖、降低门槛并融入IDE。
京东发布业界首个/开源/高完成度/轻量化「通用AI智能体产品」。
京东跨界推出业界首个开源高完成度轻量化通用智能体产品JoyAgent - JDGenie。它开箱即用、轻量可自部署,内置多种子智能体与工具,还给出二次开发示例,有多层次多模式思维等创新点。
对话鹿明CTO丁琰:数据会反向决定模型,甚至影响硬件形态 | GAIR 2025
本文是对鹿明CTO丁琰的访谈。丁琰博士最早将UMI落地实践,其数采方案「FastUMI」受青睐。他认为UMI是完整体系,数据会反向影响多方面。还对比多种数采方式,介绍FastUMI改进及Pro版优势。
听LLaMA Factory、vLLM、RAGFlow作者亲述顶级开源项目的增长法则|GOBI 2025
在开发中,开源项目易,维护让其活起来难。12月21日GOBI 2025大会上,LLaMA Factory、vLLM、RAGFlow等项目作者将分享顶级开源项目增长法则,大会还有众多精彩环节等。
腾讯开源最强3D生成模型,消费级显卡就能跑 | CVPR
在CVPR上,腾讯混元3D 2.1模型宣布开源。相比前一代,它实现几何与纹理双重优化,纹理贴面提升大,达当前开源3D模型SOTA水平。全链路开源,适配消费级显卡,Hugging Face下载量超180万。
AI开始接管实验室了!玻尔·跃迁实验室:试剂、设备、数据一个入口搞定,1800+设备即插即用
深势科技推出玻尔·跃迁实验室,解决传统实验室设备割裂、经验依赖、数据离散、部署低效等痛点,围绕计算 - 实验 - 数据 - 计算无缝闭环底层重构,与传统 ELN/LIMS 不同。