「小样本学习」共找到 2422 篇相关文章
小模型代替顶级闭源:微软用4B小助理,砍掉30% Token消耗
微软研究团队提出实用方案,用4B参数的微型模型Terminus - 4B替换昂贵顶配大模型接管终端执行任务,采用SFT和RL策略打造子智能体,经测试效果良好,节省Token消耗。
The Batch:927|极速扩散学习
研究表明扩散图像生成器学习重建预训练编码器嵌入可加快训练,Apple团队提出的FAE,通过缩小嵌入再重建解决了因嵌入尺寸大导致的训练受阻问题,性能与先进模型相当且训练更快。
深圳半导体存储器“小巨人”冲击IPO
2025年下半年存储芯片行业迈入“超级周期”,存储芯片成AI产业战略资源。近日深交所受理时创意IPO申请。该公司是“小巨人”企业,业绩近年大增,但面临原材料价格波动、存货跌价等风险。
Meta亚历山大王走人?小扎回应了
近期网传Meta AI一号位亚历山大王离职,小扎晒自拍、发言人辟谣。传闻源于新模型难产及组织架构调整,王与高层技术路线有分歧,不过Meta否认其离职,网友看法不一。
避免Claude Code 降智的一小招
Claude Code近期表现变差,简单代码逻辑会搞混,调试建议也不对。作者分享小妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。
对「学习」的一切认知都错了
曾被认为不可能的超大模型如今成功驱动ChatGPT等,改变了对学习的理解。彩票假说解释其成功:大网络有中奖子网,能提供更多找简单解的机会,调和了经验与经典理论。
视觉感知RAG × 多模态推理 × 强化学习 = VRAG-RL
数字化时代视觉信息愈发重要,传统RAG方法处理视觉信息面临挑战。阿里巴巴通义实验室的VRAG - RL将强化学习引入多模态智能体训练,革新检索生成范式,提升视觉语言模型多方面能力,代码已开源。
强化学习 AI 系统的设计实现及未来发展
本文是阿里巴巴算法专家曹宇在 AICon 2025 北京站的分享,结合算法实践展示 RL 系统现状及发展脉络,探讨未来超大规模 RL 发展方向,涉及理论基础、业界实践、开源生态及社区共建。
世界经济论坛:AI、机器学习专家,成增长最快职业
世界经济论坛《2025年全球未来就业报告》分析未来五年劳动力市场转型。AI成重塑核心,技术岗位增长,传统岗位衰退。各地区情况有别,报告给出政策与企业应对建议。
Codex「额度黑洞」终于查清!真凶竟是这个小功能
折腾一周,Codex「额度消耗过快」悬案告破。OpenAI Codex负责人Tibo Sottiaux认了三处Bug,如自动给对话起名字小功能额度消耗远超预期。官方还对所有付费订阅做完整额度重置。