数据索引能力」共找到 5150 篇相关文章

算法论文8

合成数据>人工数据,绝对性能暴涨超10个点!仅需任务定义,高效微调大模型

为解决基础模型在专业领域表现不佳、依赖人工标注数据的难题,北大、MIT等机构提出「合成数据强化学习」框架。该框架仅需任务定义,能生成合成数据微调模型,在多领域基准上性能提升显著,代码已开源。

新智元
新闻资讯7

告别传统存算分离,AI时代数据底座迎来全新底层逻辑

文章围绕AI时代数据底座变革展开。指出传统大数据平台难适配AI,存在数据够不着、模型用不好等问题。阐述AI时代基础设施变化,如数据形态、计算模式等。还探讨底座升级条件、存储挑战、算子价值及未来标准层等内容。

AI前线
产品应用8

GPT-5.4 发布,OpenClaw的能力要被取代?OpenAI 新模型不仅会自己用电脑,编程能力也拉满了

今天 GPT-5.4 发布,整合推理、编程及原生计算机使用能力。其原生电脑操作能力提升,与 OpenClaw 竞争。还带来工具搜索降成本、减少幻觉,编程能力增强但价格也升级。

AI前线
产品应用8

具身数据才是最大「金矿」,数据云商城来了:全球首个、百亿级、全模态、高自由度

帕西尼联合京东云等打造的全球首个百亿级全模态具身智能数据云商城开放。该平台解决具身智能泛化瓶颈,提供全模态数据,有端到端服务,数据质量高、体量大,还能加速具身智能进化,赋能多行业。

机器之心
产品应用8

GenAI 退烧后,这家企业正在用 “数据平台” 重构AI2B的底层逻辑

GenAI浪潮下,企业级AI落地难。矩阵起源举办新品发布会,其CEO王龙指出落地瓶颈已从大模型转向私域数据。该司推出MatrixOne和MatrixOne Intelligence,构建“数据智能飞轮”,MOI三层架构可打通数据到业务落地流程,还通过案例展现其解决实际痛点能力

InfoQ
产品应用7

甲骨文副总裁吴承杨:AI 放大了数据优势,数据融合至关重要

甲骨文公司副总裁吴承杨认为 AI 放大了数据优势,多模融合数据库至关重要。对比传统开源数据库,Oracle 能精简编排步骤。嵇小峰指出企业构建 Agent AI 要关注数据需求和安全。

InfoQ
新闻资讯8

全球首家具身数据独角兽诞生:光轮智能完成10亿元融资,开启具身数据规模化元年|甲子光年

具身智能进入数据Scaling Law时代,光轮智能完成10亿融资成全球首家具身数据独角兽。它构建了World-Behavior-Eval数据引擎体系,在多领域获国际交付冠军,客户涵盖顶尖企业,正构建物理AI时代基础设施。

甲子光年
算法论文8

调整训练数据出场顺序,大模型就能变聪明!无需扩大模型/数据规模

微软亚洲研究院提出全新文本数据组织范式DELT,通过引入数据排序策略,充分挖掘训练数据潜力,优化训练数据的组织方式,在不同模型尺寸与规模下都达到了良好性能,且不用增加数据量或扩大模型规模。

量子位
算法论文8

14B检索能力超过Google Search,阿里ZeroSearch通过RL激发LLM检索推理能力~

有效信息搜索对提升LLMs推理和生成能力重要,当前RL方法有文档质量不可控和API成本高问题。阿里通义Lab提出ZEROSEARCH框架,经多步骤训练,实验显示其在检索能力和泛化性上表现出色。

PaperAgent
产品应用7

Legora、Mercor 都在用,Reducto 能成为独立的 LLM 数据入口吗?

当前企业AI落地瓶颈在数据质量,Reducto聚焦数据准确性,以文档解析API提供Agentic OCR能力。它获多轮融资,估值达6亿美元,但面临多模态模型竞争及定价等问题,其未来走向待察。

海外独角兽