有监督微调」共找到 6430 篇相关文章

开源动态7

付费Mathpix公式识别不香了~不要钱舒服!

复杂科学文献中公式识别问题重要,但现模型局限。DocTron - Formula通过简单微调在多场景达先进水平,还引入CSFormula数据集。它基于Qwen2.5 - VL微调,在多个数据集上效果佳。

CourseAI
算法论文8

最新视觉大模型 DINOv3论文精读(逐段解析)

DINOv3是突破性自监督视觉基础模型,其创新围绕数据与模型协同扩展、Gram锚定技术、多阶段训练策略。它解决传统自监督学习难题,在多任务上无需微调达最优,为计算机视觉树立新标杆。

机器学习AI算法工程
算法论文8

无需训练的LLM对齐方法综述

大型语言模型应用引发担忧,传统微调方法短板,免训练对齐(TF Alignment)应运而生。本文是首篇系统综述TF对齐技术的论文,提出三阶段分类框架,实验显示TF方法优势明显,还指明未来研究方向。

深度学习自然语言处理
开源动态8

Agent之间,互联网了!

明略科技开源发布Octo,旨在构建开源可信的Agent协作网络,让人、Agent和外部工具进入同一协作系统。它三个核心概念、六种协作模式、四个端,推动AI应用从个人工具向组织协作网络迁移。

量子位
算法论文7

大模型刷数学题竟害?CMU评估20+模型指出训练陷阱

CMU团队评估20多个大模型,发现只强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。

量子位
产品应用7

Claude「编制」了!Anthropic发的

6月23日,Anthropic发布Claude Tag,它是常驻Slack频道的AI团队成员,自己的身份、账号和审计轨迹。其核心是权限架构,采用智能体身份,按用量计费,已对企业版和团队版客户开放beta。

新智元
算法论文8

告别微调!斯坦福提出Agentic上下文工程

当前微调大语言模型成本高、不灵活,‘上下文适应’方法短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现问题。论文通过实验验证其在性能、成本和效率上优势,为大模型发展指明新方向。

深度学习自然语言处理
新闻资讯7

求医十年,病因不明,ChatGPT:你看起来基因突变

一位Reddit网友分享,自己求医十年病因未明,ChatGPT分析出是基因突变。此帖热度高,很多人分享类似经历。AI在医疗诊断优势,但不能盲目信,最终诊断还需人类医生。

机器之心
新闻资讯8

雷军:小米一直一颗芯片的梦想

9月25日晚雷军年度演讲深情坦言,小米一直造芯梦想。其造芯始于2014年松果电子,澎湃S1虽量产但未成功,后停掉SoC研发。2024年小米成功流片3nm芯片,玄戒O1首发于小米15S Pro,表现出色,但雷军称其成功只是第一步。

芯师爷
开源动态7

OpenClaw太麻烦?没关系,你这个项目可以一斑窥豹!

nanobot是受Clawdbot启发的超轻量级个人AI助手,仅约4000行代码,比Clawdbot小99%,核心功能。它代码清晰、资源占用少、易部署,还介绍了安装、使用、配置等内容。

GitHubStore