预训练数据」共找到 3960 篇相关文章

新闻资讯8

具身数据来了实战派!40天2轮融资数千万,瞄准物理AI基础设施

近日,具身智能数据基础设施公司元点科技完成数千万元融资。其创始人郭江亮认为具身智能竞争进入下半场,本质是数据竞争。元点用MatrixOS构建数据基础设施,业务与生态全面铺开,团队实力强,瞄准2027 - 2029窗口期。

量子位
开源动态7

新颖的人形机器人训练框架

Robot - Trains - Robot (RTR)是新颖框架,机械臂教师支持引导人形机器人学生。它能以最少人工干实现高效长期真实世界人形机器人训练,文中还介绍安装设置、使用指南等内容。

GitHubStore
算法论文8

多轮Agent蒸馏终于不翻车!港中文x通义新方法成功率暴涨18点,训练还快32%

香港中文大学联合阿里通义事业群提出TCOD训练方法,解决多轮Agent蒸馏稳定性难题。它只需对现有OPD代码做极少改动,提升了模型成功率,压缩行动步数,还减少训练时间,未来或成训练长程Agent标配。

量子位
算法论文8

微小目标漏检只是因为小?从数据到代码:一文读懂 AI-TOD-R 与 DCFL 如何解决旋转微小目标检测

此文指出旋转微小目标检测存在数据空白、学习偏差、特征易丢失等难题,提出AI-TOD-R数据集、全检测范式基准和DCFL框架。DCFL可缓解偏差,在8个数据集达SOTA,还给出实战代码案例。

机器学习AI算法工程
开源动态8

7B模型对标GPT-4o,全球首个医疗代码生成大模型训练平台来了

研究团队发布全球首个医疗代码生成大模型训练平台MedAgentGym,提供评估基准和训练生态,提升大模型医疗代码生成与推理能力。经其训练的Med - Copilot - 7B达GPT - 4o相当水平,解决医疗AI编程瓶颈。

量子位
算法论文8

通义实验室最新成果WebDancer:开启自主智能Deep Research的新时代

通义实验室推出 WebDancer,解决自主信息检索智能体构建难题。它创新合成训练数据,采用两阶段训练策略应对开放网络训练挑战,在多个基准测试中表现卓越,未来还将拓展能力。

机器之心
新闻资讯7

GenEnv:智能体与环境模拟器之间的难度对齐协同进化 | 直播

训练高性能 LLM 智能体受限于真实世界交互数据的成本和特性,为此推出 GenEnv 框架,它建立难度对齐协同进化博弈,能让智能体表现提升,减少数据使用量,为扩展能力提供数据高效路径。

深度学习自然语言处理
算法论文8

大模型学会拖进度条看视频了!阿里新研究让视频推理告别脑补,实现证据链思考 | ICLR 2026

阿里巴巴未来生活实验室团队解决多模态大模型视频推理难题,推出ReWatch数据集和ReWatch - R1模型。数据集克服现有训练数据痛点,模型用SFT + RL范式及创新奖励机制,实验成绩SOTA。

量子位
算法论文8

超越RAG和DAPT!华人团队新研究引热议:即插即用、无需改变原参即可让模型化身领域专家

华人团队提出比DAPT和RAG更方便、成本更低的方法,即“Memory Decoder”训练记忆模块。它像“领域知识插件”,即插即用、不改原参,能让Qwen、Llama等模型成领域专家,还降低困惑度。

量子位
算法论文8

训练加速1.8倍,推理开销降78%!精准筛选题目高效加速RL训练丨清华KDD

清华大学THU-IDM团队与慕尼黑大学CompVis团队合作提出MoPPS框架,解决强化微调代价高问题。它精准挑题,测难度,开销低、动态适应且平衡探索利用,在多任务表现佳,降本增效,有新范式。

量子位