大数据自治」共找到 6663 篇相关文章

开源动态8

如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证

模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。

深度学习自然语言处理
推荐文章7

当AI成为预言家:数据时代,我们正在失去理解世界的能力吗?

文章借神经科学家Grace Huckins观点,探讨AI时代人类理解世界能力问题。以‘微处理器论文’实验为例,指出数据未必带来理解。还阐述理解与预测分离、科学理解危机等,强调理解应是科学核心。

AIGC开放社区
开源动态8

清华开源首个股票k线模型

清华开源首个股票K线模型Kronos,是专为金融市场K线序列预训练的模型,处理金融数据高噪声特性。采用两阶段框架,有安装、预测步骤,还有批量预测方法,项目地址为https://github.com/shiyu-coder/Kronos。

GitHubStore
新闻资讯7

AI 渗透金融行业:模型如何破解风控、服务与决策难题?

在数字化与人工智能驱动下,金融行业变革深刻。InfoQ《极客有约》X AICon 直播栏目邀多位专家探讨模型赋能金融,涉及风控、服务、决策等难题,分享了模型应用场景、技术渗透、权衡可解释性与性能等观点。

InfoQ
算法论文8

告别数据「噪音」,UCSD模型推理新方法DreamPRM充当「信号放器」,登顶MathVista测评榜

DreamPRM由加州学圣地亚哥分校团队开发,在MathVista测评榜夺冠。它通过双层优化框架解决多模态过程奖励模型训练难题,能与多模态模型集成,提升推理能力,实验效果显著。

机器之心
开源动态7

打造图像编辑领域的ImageNet?苹果用Nano Banana开源了一个超数据

苹果研究团队提出Pico - Banana - 400K数据集,基于Nano - Banana在OpenImages实拍照片生成编辑对。其系统化设计保证质量与多样性,还构建自我编辑评估流程,为图像编辑模型训练评测奠定基础。

机器之心
产品应用8

千卡集群破壁之道:vivo视觉多模态模型训练效率跃迁实战

多模态模型在多领域需求增长,但千卡级 GPU 训练挑战。vivo AI 架构师王兆雄在会演讲,结合 LLaVA 和 DiT 模型实践,解析优化策略,分享提升训练效率与稳定性的经验,还展望了 AI Infra 未来。

InfoQ
算法论文8

蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据

蚂蚁集团论文《OmniTable: A Unified Wide-Table System for Petabyte-Scale LLM Data Curation and Exploration》获VLDB工业赛道最佳论文。其研发的OmniTable系统能管理超35PB、3050亿条以上训练数据,解决数据准备难题,如在SFT任务中幅缩短周期。

量子位
算法论文8

模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion

上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。

量子位
算法论文8

首个时空时序推理框架:让模型真正读懂时空数据 | ACL'26

STReasoner是首个结合时间序列、空间结构和自然语言的推理模型,能识别异常源、追踪影响路径。研究团队构建数据生成框架和评测基准,采用三阶段训练策略,模型在多任务表现优,成本低且泛化能力强。

新智元