小样本学习」共找到 2428 篇相关文章

开源动态7

最强DeepResearch!通义DeepResearch-30B开源实战:模型部署+LangGraph+A2A全攻略

阿里发布全开源项目通义DeepResearch,在研究任务评测中表现出色,底层是30B的MoE专用推理模型,资源需求低。文章演示了基于该项目构建本地化端到端DeepResearch助理的方法,包括模型部署、Agent实现等。

AI大模型应用实践
推荐文章7

Learn to Reason _ The way of Baichuan-M1-ClinicReasoning

前百川智能研究组负责人阎栋分享大语言模型临床推理。回顾推理技术发展,以Deepseek为例;介绍百川在医疗推理实践,模型达三甲主治水平;还谈及大模型训练困境及与人类智能差异。

InfoQ
开源动态7

新颖的人形机器人训练框架

Robot - Trains - Robot (RTR)是新颖框架,机械臂教师支持引导人形机器人学生。它能以最少人工干预实现高效长期真实世界人形机器人训练,文中还介绍安装设置、使用指南等内容。

GitHubStore
开源动态8

首个基于 MCP 架构的低代码 RAG 框架

检索增强生成系统复杂度提升,科研人员面临高昂工程成本。清华大学等联合推出 UltraRAG 2.0,基于 MCP 架构,降低复杂 RAG 系统技术门槛与学习成本,支持低代码构建复杂系统。

GitHubStore
新闻资讯7

我潜伏进了"年入百万"的AI自习室,发现了一些灰色的秘密。

作者潜伏进AI自习室,发现其生意火热。AI学习机功能普通,价格却高,主要卖点是内置课程。AI督学职责是托管和销售。AI自习室盈利宣传有水分,实则钻政策空子赚教育焦虑的钱。

数字生命卡兹克
推荐文章8

科普向:一文解构大模型后训练,GRPO和它的继任者们的前世今生

文章深入解读大模型后训练,先对比 PPO 与 GRPO,指出 GRPO 优势及成本问题。又介绍 GRPO 后续改进算法,如 DAPO 解决训练问题、GSPO 提升训练稳定性、GFPO 可优化多属性,还提及 GRPO 其他缺陷。

机器之心
推荐文章7

“都什么年代了程序员还在手搓代码,连白都能写 Prompt 生成代码了”

现在很多人标榜用 AI 写代码高效,贬低手搓代码。作者认为两者都是写代码的手段,不是目的,不能对立。并从多方面分析适合 AI 或手搓代码的场景,强调二者搭配使用能事半功倍。

宝玉AI
产品应用7

本地运行OpenAI Whisper语音识别模型,Unity3d环境下高性能离线转写解决方案

这是为whisper.cpp提供的Unity3D绑定库,能在本地设备高性能运行OpenAI Whisper自动语音识别模型推理。支持多语言识别与翻译,有不同大模型,可本地运行,还介绍了使用方法。

GitHubStore
产品应用7

6K星 Qwen围绕Web AI,打造Agent Search新生态

自Manus带火深度研究代理后,新兴方向面临多模态代理推理能力不足等问题。千问2025年推出系列工具完成web智能搜索生态闭合,本文分享WebWatcher训练及解决问题的方法。

CourseAI
产品应用8

马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维链模型,推理完爆 o3-mini-high

新加坡 Sapient Intelligence 推出型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济性,可提升任务效率。

InfoQ