预训练数据」共找到 3960 篇相关文章

新闻资讯7

突发!卡帕西宣布入职Anthropic

大神Karpathy宣布加入Anthropic,重回一线大厂。他曾多次在AI领域转换角色,此次将加入训练团队,开展用Claude加速自身训练研究。外界揣测其离开OpenAI原因,加入Anthropic能为研究提供更多资源。

量子位
推荐文章8

多模态大语言模型的核心技术架构与训练方法的进化

文章深入剖析多模态大语言模型核心技术架构与训练方法的进化,涵盖建模范式、视觉编码器、语言骨干网络、模态对齐、生成范式及训练方法等方面,介绍其演进路径与代表模型,还提及国内模型创新及开源模型OpenVLA。

AIGC开放社区
开源动态8

3000块钱,这支中国团队把ChatGPT成功的“秘密”用在了机器人训练

国内穹明智能团队推出千元级手持采集系统 UMI ver.2 并开源。该系统精度达毫米级、能双臂协同,成本低、部署快。团队认为数据是关键,还计划搭建机器人数据 infra,计新模型范式很快出现。

AI前线
推荐文章8

YOLOv8 模型训练入门指南:手把手搞定目标检测AI

本文是从零训练 YOLOv8 模型的完整实录,介绍了 YOLOv8 特点,以“识别猫”为例,详述训练步骤,指出训练难点,还推荐学习资源与工具,鼓励前端程序员尝试做 AI 模型训练

AI Reading Hub
算法论文8

ACL 2026 | 腾讯混元Agents工具学习新范式

腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在训练。它从真实代码挖工具,写说明书,融入训练,实验显示能有效提升工具运用能力,但也有局限和成本。

PaperAgent
算法论文8

刚刚,OpenAI找到控制AI善恶的开关:ChatGPT坏人格在训练阶段已成型

OpenAI最新论文揭示控制AI“善恶”开关。研究发现训练模型在某领域答错题,会致其在其他领域“学坏”,还找到“毒性人格特征”。同时给出解决办法,能让模型恢复正常。

量子位
算法论文8

MIT新研究:大模型加噪声就能替代GRPO/PPO调参

MIT新论文提出,训练模型周围存在大量“专家模型”,只需添加高斯噪声并集成,性能就能比肩甚至超越GRPO/PPO等调参算法。由此启发了RandOpt算法,经测试准确率不错,但也有依赖训练等缺点。

量子位
新闻资讯6

科技赋能 未来已来 | 人形机器人训练中心探秘 @首钢园

文章探秘首钢园的人形机器人数据训练中心,提及机器人学习的情况,还列出了相关参考资料,展现科技赋能下人形机器人领域的发展。

首钢园
推荐文章7

ACL'25首届博士论文奖 | 重新思考 LLM 中的数据使用

近日,第一届 ACL 计算语言学博士论文奖获得者是 Sewon Min,其论文《重新思考大型语言模型中的数据使用》围绕大型语言模型如何使用训练所用的庞大文本语料库展开研究。

PaperAgent
新闻资讯8

深度|Karpathy为何突然加入Anthropic,只能当Dario的「-2」?

5月19日,OpenAI联合创始人Andrej Karpathy宣布加入Anthropic训练团队。他将组建新团队,用Claude加速训练研究。文章分析了他加入的原因,以及Anthropic招聘他的动机,还指出这一变动标记着技术拐点。

新智元