「训练数据污染」共找到 3919 篇相关文章
大语言模型高考数学拿高分靠强化学习,那文科考高分得靠什么?
大语言模型在高考数学拿高分靠强化学习,但文科题无标准答案,此方法行不通。豆包1.6系列高考文科全科获683分,靠训练数据、思维链、长上下文和多模态直接读图等因素。
FaceAge登上「柳叶刀」!AI一张照片看穿你的真实年龄
科学家开发AI工具「FaceAge」,登上《柳叶刀数字健康》。它能通过人脸照片预测癌症患者生物年龄辅助治疗。研究显示,脸显老的患者治疗效果差。不过,它存在训练数据局限,离临床应用还有距离。
阿里最新开源王炸Agent!性能全面SOTA!
阿里WebAgent更新频繁,基本一月一版。它是类似DeepResearch的通用智能体,历经WebWalker到WebWatcher多阶段演进,各阶段解决不同问题,如网页导航、自主信息搜集等,还不断优化训练数据生成与处理方式。
20种机器人本体通吃!蚂蚁新一代VLA具身大脑刚刚开源了
2026 年具身智能 VLA 受关注,蚂蚁灵波发布新一代具身基座模型 LingBot-VLA 2.0,支持 20 种机器人构型,多方面能力提升,开源模型权重等,从架构、数据、后训练解决跨本体难题。
ComposeMe:让发型、服饰与身份随心组合的人体图像生成新范式
人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。
从答题到做实验:SciAgentGym让大模型进入科学工作流
复旦大学NLP实验室提出SciAgentGym,为科学智能体搭建工作流环境,还设计了评测集SciAgentBench。实验显示模型接入工具能提升成功率,但长流程任务性能下降。论文还提出SciForge构建训练数据,提升了模型表现。
桌面 Agent 的下一步:不是会操作,而是会调度工具
复旦大学和通义实验室提出 ToolCUA,让模型在 GUI 与工具调用间编排路径。它从已有 GUI 轨迹合成训练数据,设计奖励机制,在 OSWorld - MCP 评测中效率与准确率大幅提升,为 CUA 发展提供方向。
Sutton 的批评与反思:AGI 的下一步是什么?
文章是对 Richard Sutton 采访的反思,指出 LLM 训练效率低、依赖人类数据,未实现有机自主学习。作者与 Sutton 有分歧,认为模仿学习与强化学习互补,还探讨持续学习,称 Sutton 批评有启发性。
马斯克刚关注了这份AI报告
受谷歌DeepMind委托,Epoch发布报告剖析2030年AI的发展。指出训练成本或超千亿美元,公开文本数据2027年耗尽等,马斯克也关注此报告。还从多方面论证发展趋势可延续,且AI将加速多领域科研。
她拒了贝索斯,离开黄仁勋,只为回答一个问题:AI能学会物理世界吗?
近日,AI初创公司Accelerated Understanding亮相,由Anima Anandkumar夫妇创立。它未随主流,目标是训练模拟物理现象的通用AI模型。该模型处理数据规模大,公司想解决AI验证瓶颈,产品面向科研工程机构。