算法论文8
谷歌DeepMind:暗网毒数据也能训出好模型
新智元
AI 摘要
谷歌DeepMind团队提出GDR方法,净化原始数据。该方法输入真实数据,用大模型改写,输出精炼数据集。实验表明,它在代码匿名化、对话去毒化等方面效果佳,还能增强数据多样性。
阅读原文 · 新智元
谷歌DeepMind「粪坑淘金」全新方法,暗网毒数据也能训出善良模型
谷歌DeepMind研究团队发表论文提出生成式数据精炼(GDR)方法,不直接生成新数据,而是用大模型净化原始数据,保留有用信息。该方法能解决数据枯竭、隐私等问题,实验显示效果良好。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
算法论文8
颜见智团队:启发学习让大模型自我进化
当下大模型能力多靠人为框架,能力上限受限。文章提出“启发学习”,将其集成到推理侧成Isaac框架,通过Prompt与网络层注入复用旧经验,实验显示能大幅提升大模型任务性能。
机器之心
新闻资讯7
Marin 535B模型公开训练,吴恩达力挺!
当多数模型公司还在争论是否开放权重时,斯坦福大学的Marin项目启动535B-A23B模型训练,并公开训练过程。该项目旨在探索基础模型能否像开源软件一样被公开研究和建设,引发关注。
InfoQ
新闻资讯7
Tibo 揭秘 OpenAI 额度重置及产品发展策略
围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。
InfoQ
推荐文章7
向量存储:支撑Agent检索链路新势力
文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。
阿里云开发者