有监督微调」共找到 6453 篇相关文章

开源动态8

我去,还能这么玩?AI新宠DocExt:纯本地文档抽取,开源免费还无依赖!你还在为OCR头疼吗?

DocExt 是 Nanonets 开源项目,为全流程无 OCR、零云依赖的本地文档结构化提取工具,适用于多种文档类型,支持字段与表格识别。它零 OCR 误差小、可本地部署,还能灵活接入模型。

小华同学ai
算法论文8

Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用全部token训练还好

Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。

量子位
新闻资讯7

AI 造谣,无人能幸免。

文章以现实中谣言传播现象为引,指出移动互联网加速谣言传播,而AI技术发展使真假更难分辨,如AI生成的图片、视频易以假乱真,还提到谷歌发布水印检测工具应对,呼吁大公司行动。

MacTalk
算法论文8

首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。

量子位
开源动态7

字节开源了一个了不得的模型!

字节跳动开源统一多模态基础模型BAGEL,一个模型能同时理解和生成文本、图像、视频。部署测试亮点但效果不稳定,还分享该模型体验Demo、地址及安装使用教程。

探索AGI
开源动态7

DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2

昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。

机器之心
产品应用7

GitHub Copilot新代理把「自家人」逼疯了!

GitHub Copilot新智能体Coding Agent公测,官方想让它成协作开发搭子。但在微软仓库使用时问题多,多次提交失败、逻辑不通,未解决关键问题,虽能自动完成繁琐任务,但距‘靠谱搭子’还远。

AI科技大本营
开源动态7

LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析

文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍了该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述了数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。

GiantPandaLLM
新闻资讯8

半世纪计算机理论僵局被打破!MIT科学家偶然发现:少量内存节省大量计算时间

MIT科学家威廉姆斯偶然发现,证明内存比大家认为的更强大,少量的内存与大量的时间一样价值。他证明存在数学程序,可将算法转换成占用更少空间的形式,成果获好评。

量子位
推荐文章7

5Y View|如何打造真正用的AI产品?生成式AI改变的创业规则

本文围绕如何打造真正用的AI产品展开,以Granola为例,阐述生成式AI领域创业需新打法,如不浪费时间解决即将消失的问题、利用边际成本创造机会、重视上下文及聚焦特定场景等。

五源资本 5Y Capital