新闻资讯8
腾讯120元AI训练法秒杀70000元方案
量子位
AI 摘要
腾讯优图团队提出Training-Free GRPO方法,无需调参,通过学习经验提升LLM性能。实验表明,在数学推理和网页搜索任务中,该方法效果显著且成本低,还能让智能体高效用工具。
阅读原文 · 量子位
腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案
腾讯提出无训练组相对策略优化Training-Free GRPO,无需调整参数,在提示词中学习经验就能提升模型性能。实验显示,该方法在数学推理和网页搜索任务上效果显著,成本远低于传统方法。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
推荐文章7
向量存储:支撑Agent检索链路新势力
文章指出大模型负责理解、推理和生成,而Agent需获取外部数据等。向量存储可将数据转化为语义向量,在Agent执行任务时找回相关内容。文章探讨向量存储技术方向,分享做法,还演示阿里云两种Serverless向量存储用法。
阿里云开发者
新闻资讯8
奥特曼:AI缺iPhone时刻,OpenAI聚焦平台
OpenAI首席执行官山姆·奥特曼在深度对谈中复盘大模型发展,谈及砍掉Sora和自研浏览器聚焦平台,认为AI缺iPhone时刻,还分享ChatGPT决策过程、创业经历,提出从成功学经验等观点,反驳末日论。
AI寒武纪
新闻资讯8
英伟达首测Vera Rubin,Agent时代格局重写
英伟达公布下一代旗舰级机柜Vera Rubin NVL72片上实测数据,用DeepSeek - V4 - Pro跑任务,每兆瓦吞吐量最高升30倍、Token成本最高降35倍。还宣布Groq 3 LPX量产,推出Agent专属Vera CPU,被SpaceXAI采用。
新智元
新闻资讯8
斯坦福教授直播训练535B大模型
斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去大模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。
机器之心