训练数据污染」共找到 3919 篇相关文章

开源动态7

详解Github 35K+项目:打通200+数据源,构建企业级AI的数据统一入口,支持MCP【下篇】

本文继续介绍MindsDB这款开源AI数据引擎,阐述知识库与混合检索应用,如创建向量索引、语义检索、多源混合检索等;还提及RAG与数据智能体,包括构建RAG管道和配置Data Agent;最后给出应用建议,称其适合复杂企业环境。

AI大模型应用实践
算法论文8

奖励模型预训练新范式POLAR:突破强化学习短板,有望打通RL链路扩展“最后一环”

强化学习中奖励模型设计与训练是瓶颈,上海人工智能实验室提出奖励建模新范式POLAR。它摆脱传统“绝对偏好”限制,契合强化微调框架,通过对比学习训练,实验证明其性能和泛化性佳,有望打通RL链路扩展最后一环。

OpenMMLab
新闻资讯8

剑指“美国版 DeepSeek!”Ai2 科学家 Nathan Lambert 最新访谈:剖析 RLVR、激辩智能体与后训练

艾伦人工智能研究所科学家 Nathan Lambert 在访谈中剖析 RLVR、激辩智能体与后训练。他所在团队用 Olmo 和 Tulu 模型揭开后训练魔法,带火 RLVR 概念。他还谈到开源 AI 未来,想打造“美国版 DeepSeek”。

AI科技大本营
产品应用8

OceanBase全面拥抱AI新进展:OB Cloud支持十亿级多类型向量数据,数十家企业实现AI应用落地

大模型热潮下,企业面临AI落地难题。OceanBase的OB Cloud支持十亿级多类型向量数据,已有数十家企业实现AI应用落地。它具备多云原生、AI能力优势,提供一体化架构和多模向量一体化,还降低了AI应用门槛。

量子位
算法论文8

Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本

大模型微调(SFT)是主流LLM落地方案,但大家默认训练完就是学完了。腾讯混元团队发现SFT存在不完全学习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。

量子位
新闻资讯8

卡帕西8000行代码手搓ChatGPT,成本仅100美元,训练12小时CORE表现超越GPT-2,手把手教程来了

AI大神Andrej Karpathy新作nanochat,用8000行代码、100美元成本纯手搓克隆ChatGPT。它是极简全栈训练/推理pipeline,训练12小时,CORE表现超GPT - 2,还给出快速上手详细指南。

量子位
开源动态8

搜索智能体RAG落地不佳?UIUC开源s3,仅需2.4k样本,训练快效果好

当前 Agentic RAG 落地有挑战,UIUC 和 Amazon 提出 s3 训练范式。它仅需 2.4k 样本,训练快且效果好,解决了优化目标偏离、检索与生成耦合等问题,在通用和医学 QA 任务中表现出色。

机器之心
开源动态8

银河通用LDA定义全域数据利用范式,跨本体世界动作大模型开启具身GPT-2时刻

当下具身智能赛道两大流派各有短板,银河通用推出跨本体「隐式世界 - 动作基础模型」LDA - 1B,走自研WAM路线,成果已开源。它打破数据割裂难题,解锁具身智能「GPT - 2时刻」,在多方面展现优势。

量子位
新闻资讯8

机器学习先驱Daphne Koller警告:AI制药不是魔法棒,下一代药物发现还缺1000倍数据

知名学者 Daphne Koller 在 a16z News 发文指出,AI 制药当前最受关注的进展多在分子设计,但新药研发难题在上游,疾病机制的靶点选择错误导致大量临床试验失败,且当前数据距构建完整生物学因果模型差约 1000 倍。

DeepTech深科技
算法论文7

Qwen3 变身扩散语言模型?不从零训练也能跑,30B参数创纪录

扩散语言模型(DLM)潜力大但训练难,Radical Numerics团队改造Qwen3-30BA3B,推出30B参数的开源扩散语言模型RND1-Base。该研究系统性研究A2D转换关键因素,成果超现有部分模型,还提出简单方法及训练策略。

机器之心