「两阶段训练法」共找到 3112 篇相关文章
3 个月达成 5 亿平台播放量,Wispr Flow 分享如何做好红人营销
Wispr Flow是语音输入法中出圈且具代表性的产品,增长快、付费强、使用频。其靠红人营销3个月在两平台获超5亿播放量。19岁实习生分享经验,涵盖招人、判断品味、分层管理等方面。
The Batch: 893 | 从预测到执行
2026 年 AI 研究应认识到能预测的模型不等同于能行动的系统。过去十年在被动预测和生成建模成就非凡,但现实任务需系统执行一系列动作。转向长周期任务和目标导向 AI 系统有两大好处。
阿里云的“反差”2025:于无声处寻找 ASI
2025年云栖大会上,吴泳铭称实现AGI是确定事件,ASI才是终局。实现ASI需满足两大条件,结合阿里投资计划,阿里云将成企业AI时代支撑者。虽市场份额增长,但利润下降,2025年阿里云极具“反差感”。
突发!英伟达H200对华解禁,老黄赢麻了
特朗普拍板允许英伟达向中国出售H200,美确保“代差优势”,还抽25%分成。H200性能是H20的6倍,虽落后最新架构,但适合训练推理,此决定或为英伟达带来巨额销售额。
今天的AI基建狂潮,恰如150年前铁路狂潮的历史轮回
文章指出铁路与AI这两场相隔150年的基建狂潮,上演着相同剧本:技术突破引发资本涌入,过度建设致过剩,泡沫破灭后洗牌。回顾美国铁路建设兴衰,类比当下AI投资,给出周期阶段信号及价值转移路径。
RLinf上新πRL:在线强化学习微调π0和π0.5
近年来,基于流匹配的VLA模型成机器人领域前沿技术,但训练依赖大量人类演示数据。清华等机构联合推出在线强化学习微调框架πRL,提出两种微调方案,在测试平台验证了有效性,目前代码等已开源。
斯坦福7B智能体全面超越GPT-4o,推理流登顶HF
传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。
马斯克、奥特曼新口水战又曝新瓜,马斯克认定OpenAI必死才离开?!奥特曼:你不能翻篇吗?
马斯克和奥特曼又起争执,源于奥特曼退特斯拉预订款一事。马斯克指责奥特曼偷非营利组织,还多次批评OpenAI背离初心。双方多年矛盾不断,诉讼也在推进,此外马斯克还回应了自身相关争议。
OpenAI启动新实验,46万学生参与
硅谷巨头正秘密培养首批「AI原生代」,OpenAI等推动下,CSU欲成美国最大AI赋能大学,花费1690万美元采购OpenAI的Edu服务,引发是培养人才还是制造顺从AI机器的讨论。
LeRobot v0.4.0 正式发布:全面提升开源机器人的学习能力
LeRobot v0.4.0 正式发布,带来多方面重大升级。有可扩展的 Datasets v3.0、新 VLA 模型、全新插件系统;支持 LIBERO 和 Meta - World 仿真;还有数据处理 Pipeline、多 GPU 训练简化等特性,上线了机器人学习课程。