元数据性能」共找到 4579 篇相关文章

开源动态8

腾讯混AI Infra核心技术重磅开源:推理吞吐提升30%!

腾讯混AI Infra团队开源生产级高性能LLM推理核心算子库HPC-Ops,基于生产环境痛点开发,降低底层算子开发门槛,实现显著性能突破。在真实场景下,混、DeepSeek模型推理QPM提升,单算子性能也超越主流算子库。

腾讯技术工程
新闻资讯8

具身数据来了实战派!40天2轮融资数千万,瞄准物理AI基础设施

近日,具身智能数据基础设施公司点科技完成数千万融资。其创始人郭江亮认为具身智能竞争进入下半场,本质是数据竞争。点用MatrixOS构建数据基础设施,业务与生态全面铺开,团队实力强,瞄准2027 - 2029窗口期。

量子位
算法论文8

ICCV2025 | One image is all you need,多模态指令数据合成,你只管给图,剩下的交给Oasis

近年来多模态指令数据合成依赖人工设计提示词,成本高。本文提出 Oasis 方法,仅靠图像生成数据,打破传统输入模式,还开源代码库 MM - INF。实验显示其数据多样,能提升 MLLM 性能

机器之心
产品应用8

Pinecone 推出 Nexus 引擎:为 AI 智能体整合业务上下文并生成结构化数据

Pinecone Nexus 全面上线,是面向 AI 智能体的“知识引擎”,能将企业数据转为结构化数据层,复用数据提准确性、降成本。早期采用者在金融、法律领域看到显著性能提升,词消耗大幅降低。

InfoQ
新闻资讯8

从 “管好数据” 到 “让数据生智”,华为再发新作《数据空间探索与实践》| 文末赠书

2025年11月15日,机械工业出版社牵头举办研讨会,庆祝《华为数据之道》发行五周年及《数据空间探索与实践》上市。行业大咖齐聚,共话数据治理演进,两书为行业提供了有价值的参考。

InfoQ
算法论文8

NIPS 2025 Spotlight | 港大提出TreeSynth方法,一句话生成百万规模数据

港大团队提出TreeSynth方法,受决策树启发,将数据合成问题映射到其空间分割机制。它采用两阶段流程,能从零合成数据,还可优化现有数据集。实验显示其在多基准任务上性能提升显著,可扩展性佳。

机器之心
产品应用8

The Batch: 968 | Muse Code 想获取你的数据

Meta推出Muse Code编码框架及Muse Spark 1.2模型,有不同输入输出、功能和性能表现。提供不同档位价格,贡献者档位低价但数据用于训练。测试显示其单任务成本低,Meta此举或为获取编码训练数据

DeeplearningAI
推荐文章7

性能全闪并行文件系统的设计和实践

焱融科技 CTO 张文涛在 QCon 大会分享‘高性能全闪并行文件系统的设计和实践’,介绍了焱融全闪文件存储架构和 YRCloudFile 技术细节,分享其解决 AI 训练存储难题的方案。

InfoQ
开源动态8

不用千亿参数也能合成高质量数据!这个开源框架让小模型“组团逆袭”,7B性能直追72B

上海人工智能实验室与中国人民大学提出GRA框架,以“多人协作”理念让小模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对大模型蒸馏依赖,展现“集体智能”潜力。

量子位
开源动态8

工业级 LLM 数据工程:北京大学 DCAI 团队 DataFlow 框架的架构设计与实践

2026 年大模型研发从‘模型中心’向‘数据中心’演进,数据语义密度与工程精度成突破关键。北京大学 DCAI 团队推出 DataFlow 框架,解决数据准备难题,其技术报告登顶 Hugging Face。该框架有多种特性,实验验证其能提升模型性能

InfoQ