「无数据训练」共找到 4369 篇相关文章
SaaS 已死?不,SaaS 会成为 Agent 时代的新基建
文章指出AI Agent不会杀死传统软件系统,传统SaaS系统会成Agent时代的新基建。企业内部数据混乱,Agent能力上限取决于对数据的运用,CRM、ERP等系统将从服务人转向服务Agent,记录系统会被拆解重构。
Sea AI Lab 揭秘:你费尽心力调的 LLM 一直在崩溃?罪魁祸首可能只是一个参数:BF16
Sea AI Lab 和新加坡国立大学研究指出,强化学习微调中训练不稳定和性能瓶颈,根源是数值精度 BF16。其低精度造成“训练 - 推理不匹配”,使训练易失败。将精度切换到 FP16 可解决问题,提升模型表现。
OpenAI没做到,DeepSeek搞定了!开源引爆推理革命
文章围绕大语言模型推理能力展开,介绍了推理模型概念,回顾RLHF训练流程,对比OpenAI的PPO和DeepSeek的GRPO,还阐述了GRPO开源升级版DAPO的关键技术点及训练中模型的新能力。
比起让大模型写 100 万字的小说,AI 大牛们更想用 AI 拿诺贝尔奖
OpenAI前CPO Kevin Weil创业,新公司定位是“为AI模型收集科学数据”的平台,估值达7.5亿美元。AI4S赛道成为硅谷离职AI高管热门去向,正从概念叙事进入基础设施建设阶段,包括数据、模型、应用层。
万字总结:如何练就适配人形机器人的可靠「灵巧手」?|GAIR Live
在具身智能崛起时,灵巧手成人工智能落地核心突破口。2025年5月25日相关线上沙龙中,嘉宾围绕灵巧手软硬件、数据与模型、落地应用等交流,探讨数据难题、开源价值、落地挑战及中美差距等。
阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning
阿里与清华研究发现,训练大语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。
20亿砸向00后创业机器人公司!估值一年暴涨7倍,国家级资本重仓
近日,灵初智能完成约20亿元天使轮及Pre - A轮融资,资金将用于物流场景落地与数据采集体系建设。其团队互补,突围逻辑是All in人类原生数据,自研采集方案,走“模型驱动数据”路径,定位“大脑驱动公司”。
中学生就能看懂:从零开始理解LLM内部原理【十】| “过拟合” 与 Dropout
文章围绕神经网络过拟合问题展开,介绍了过拟合的概念、危害及产生原因,阐述了缓解过拟合的正则化方法,重点介绍了Dropout随机失活,还指出其局限性及在大模型中的应用策略。
Reasoning模型在RL下的探索欲望急速下降问题:探索熵机制
论文研究发现大模型经强化学习训练解题时,会出现模型探索欲望急速下降的熵崩溃现象,如训练初期策略熵断崖式下跌。对此进行规律分析、追根溯源,提出破解方法,研究对AI训练范式变革有重要意义。
这波AI淘金热里,卖“铲子”的公司正闷声发财,“征服"了几十家国内外巨头!
光轮智能联合创始人杨海波表示,AI发展让合成数据需求增大。该公司为具身智能行业提供3D合成数据,服务众多头部企业。其优势在于技术视野与路径独特,强调物理交互、人类示范等。还谈及创业要点与AI赛道变化。