小样本学习」共找到 2422 篇相关文章

推荐文章7

模型代替顶级闭源:微软用4B助理,砍掉30% Token消耗

微软研究团队提出实用方案,用4B参数的微型模型Terminus - 4B替换昂贵顶配大模型接管终端执行任务,采用SFT和RL策略打造子智能体,经测试效果良好,节省Token消耗。

AIGC开放社区
算法论文7

The Batch:927|极速扩散学习

研究表明扩散图像生成器学习重建预训练编码器嵌入可加快训练,Apple团队提出的FAE,通过缩嵌入再重建解决了因嵌入尺寸大导致的训练受阻问题,性能与先进模型相当且训练更快。

DeeplearningAI
新闻资讯7

深圳半导体存储器“巨人”冲击IPO

2025年下半年存储芯片行业迈入“超级周期”,存储芯片成AI产业战略资源。近日深交所受理时创意IPO申请。该公司是“巨人”企业,业绩近年大增,但面临原材料价格波动、存货跌价等风险。

芯师爷
新闻资讯7

Meta亚历山大王走人?扎回应了

近期网传Meta AI一号位亚历山大王离职,扎晒自拍、发言人辟谣。传闻源于新模型难产及组织架构调整,王与高层技术路线有分歧,不过Meta否认其离职,网友看法不一。

量子位
产品应用7

避免Claude Code 降智的一

Claude Code近期表现变差,简单代码逻辑会搞混,调试建议也不对。作者分享妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。

AGI Hunt
推荐文章8

对「学习」的一切认知都错了

曾被认为不可能的超大模型如今成功驱动ChatGPT等,改变了对学习的理解。彩票假说解释其成功:大网络有中奖子网,能提供更多找简单解的机会,调和了经验与经典理论。

AI寒武纪
算法论文8

视觉感知RAG × 多模态推理 × 强化学习 = VRAG-RL

数字化时代视觉信息愈发重要,传统RAG方法处理视觉信息面临挑战。阿里巴巴通义实验室的VRAG - RL将强化学习引入多模态智能体训练,革新检索生成范式,提升视觉语言模型多方面能力,代码已开源。

PaperAgent
推荐文章7

强化学习 AI 系统的设计实现及未来发展

本文是阿里巴巴算法专家曹宇在 AICon 2025 北京站的分享,结合算法实践展示 RL 系统现状及发展脉络,探讨未来超大规模 RL 发展方向,涉及理论基础、业界实践、开源生态及社区共建。

AI前线
新闻资讯8

世界经济论坛:AI、机器学习专家,成增长最快职业

世界经济论坛《2025年全球未来就业报告》分析未来五年劳动力市场转型。AI成重塑核心,技术岗位增长,传统岗位衰退。各地区情况有别,报告给出政策与企业应对建议。

AIGC开放社区
新闻资讯7

Codex「额度黑洞」终于查清!真凶竟是这个功能

折腾一周,Codex「额度消耗过快」悬案告破。OpenAI Codex负责人Tibo Sottiaux认了三处Bug,如自动给对话起名字功能额度消耗远超预期。官方还对所有付费订阅做完整额度重置。

新智元