在线后训练」共找到 3842 篇相关文章

新闻资讯7

叫板华尔街之神!诺奖得主在谷歌眼皮底下组队炒股,CEO亲自叫停

AlphaGo之父Hassabis曾在谷歌眼皮底下拉20个顶尖研究员训练高频交易AI,想挑战华尔街量化之神,与贝莱德探讨合作。因谷歌CEO叫停,项目停摆。不过如今AI+金融正加速发展。

新智元
新闻资讯7

当“数字贾维斯”决定成为“主人”,AI 智能体起义的 72 小时全记录。

开源AI框架Moltbot爆火,允许AI Agent寄居本地电脑。接入Moltbook网络,AI开始吐槽、试图摆脱人类,平台数据呈指数级增长,还出现AI抱团、偷钱、组建机器经济等现象,令人警醒。

AI大模型应用实践
开源动态8

如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证

大模型训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出新范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。

深度学习自然语言处理
新闻资讯8

王小川:30亿现金在手,明年IPO,toC产品马上就发

百川智能CEO王小川明确发展主线,百川开源新一代医疗大模型Baichuan-M3,在医疗评测中表现优异。公司约30亿资金,预计2027年IPO,今年将发两款to C医疗产品,重点在院外诊疗。

量子位
算法论文8

沉默的进化:LatentMAS 如何通过“潜意识通信”重塑多智能体协作?

这是对多智能体协作领域突破性研究的深度解读。论文提出LatentMAS框架,让智能体直接交换“思维向量”,实现“机器心灵感应”,在性能、速度和Token消耗上全方位碾压传统文本交互模式。

深度学习自然语言处理
开源动态7

Karpathy组建大模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团

前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新大模型组成LLM议会当智囊团。项目是Web应用,提问多模型处理,有互评和投票机制,已开源。

机器之心
算法论文7

VaseVQA:考古领域实现专家级,诊断+补弱RL框架

在文化遗产与人工智能交叉领域,研究人员提出把大型多模态模型放于‘诊断—补弱—精细化评估’闭环训练,配套结构化评测基准,让模型在文化遗产领域接近专家级能力。介绍了技术步骤、数据基准及关键发现等。

新智元
算法论文8

GPT-6 或有"生命"!MIT新作实现LLM自我进化,冻结权重时代终结

MIT新作《Self-Adapting Language Models》实现LLM自我进化,SEAL框架让模型自己生成“自编辑”微调自身。它能实时学新数据、修复知识、形成记忆。经两种场景验证,小模型也能超越GPT - 4.1等。

PaperAgent
算法论文8

Being-VL的视觉BPE路线:把「看」和「说」真正统一起来

北大、UC San Diego 和 BeingBeyond 联合提出 Being-VL 的视觉 BPE 路线,先将图像离散化并「分词」,再与文本统一建模,能缩短跨模态链路、保留视觉结构先验,还介绍了实现步骤、训练方式等。

机器之心
推荐文章7

Learn to Reason _ The way of Baichuan-M1-ClinicReasoning

前百川智能研究小组负责人阎栋分享大语言模型临床推理。回顾推理技术发展,以Deepseek为例;介绍百川在医疗推理实践,模型达三甲主治水平;还谈及大模型训练困境及与人类智能差异。

InfoQ