小样本学习」共找到 2422 篇相关文章

开源动态7

Unsloth宣布更新,可免费用强化学习训练视觉大模型Qwen2.5-VL-7B

Unsloth宣布更新,支持视觉/多模态模型强化学习训练,含Gemma 3和Qwen2.5 - VL。其独特机制使VLM RL训练速度提升、显存占用降90%等。还引入GSPO算法,能在免费Colab T4 GPU训练Qwen2.5 - VL - 7B。

AI工程化
算法论文8

复旦、同济和港中文等重磅发布:强化学习在大语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三大贡献。

机器之心
新闻资讯7

刚刚!扎写信:暗示要放弃开源路线,加入close AI行列,未来10年打造个人超级智能

扎发信称要打造并赋能个人超级智能,虽未明说放弃开源,但暗示谨慎选择开源内容,似要加入Close AI行列。Meta愿景是让个人超级智能普及,与业内部分观点不同。

AI寒武纪
新闻资讯7

马斯克收购OpenAI新计划实锤了:找扎筹千亿美元,果然敌人的敌人就是朋友…

今年2月马斯克为收购OpenAI找扎克伯格筹资974亿美元,想拉其入伙,曾有激烈冲突的二人放下前嫌,但Meta婉拒。扎忙于组建“亿元俱乐部”,OpenAI则因人才流失致HR负责人离职。

量子位
新闻资讯7

Base44 现在每天增 40 万美金 ARR,华人团队做了一个 AI 学习相机很有意思

被 Wix 收购的 AI Coding 产品 Base44 发展迅猛,每天新增约 40 万美金 ARR。同时,行业对 AI Coding 产品利润存质疑,a16z 反驳后又遭 Cline 批判。此外,还提到华人团队做的 AI 学习相机有创新点。

投资实习所
算法论文8

一个省略号提示+强化学习搞定大模型“过度思考”,中科院自动化所新方法:从强制推理到自主选择

中国科学院自动化研究所联合鹏城实验室提出AutoThink方法,用省略号提示和多阶段强化学习,让推理大模型依题目难度自主切换思考模式,解决过度思考问题,在多数据集验证有效。

量子位
开源动态7

DeepSeek揭秘o1后,红书似乎破解了o3的技术路线,还开源了~

OpenAI闭源后,大家不知其先进模型技术路线,解密成重要任务。DeepSeek R1年初开源后引发关注,红书团队核心贡献的论文似破解o3谜题,还开源模型等,为训练调优提供可行路线。

探索AGI
新闻资讯7

社区供稿丨Hugging Face创始人 x 红书技术副总裁:关于开源、AI与技术人成长

今年1024程序员节,红书技术副总裁凯奇、语音模型技术负责人风龙与Hugging Face联合创始人Thomas Wolf深度对谈。围绕AI Coding、开源、AGI等核心观点展开,探讨开源闭源、AGI未来、AI人味及个人能力等话题。

Hugging Face
开源动态8

Github 3.6k star,爆火开源「红书 MCP」:一键登录、图文发布、搜索、评论全搞定

`xiaohongshu-mcp`把浏览器手工步骤封装成可编排工具,以Go编写,能在无头/有界面模式间切换。它解决红书运营多痛点,如登录不稳、发帖链路长等,覆盖登录、发帖等全链路,适配多客户端,值得收藏上手。

小华同学ai
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁大模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强大泛化能力。

量子位