后训练方法」共找到 4816 篇相关文章

推荐文章8

一篇200+文献的视觉强化学习技术最新综述

NUS、浙江大学和香港中文大学对强化学习与视觉智能交叉领域进行系统梳理,归纳200余篇工作为四大主题支柱,剖析算法等进展,提炼关键趋势,还介绍LLM的RL方法、视觉RL阵地等。

PaperAgent
算法论文8

集成20+先进算法,优于GPT-4o,自主因果分析智能体来了

加利福尼亚大学圣迭戈分校研究团队提出自主因果分析智能体 Causal - Copilot,集成超 20 种算法。它解决因果分析使用门槛高、预训练模型有局限等问题,性能优于 GPT - 4o ,已开源邀全球研究者参与。

机器之心
开源动态8

被 AI 大厂逼至绝望,这帮欧洲人发起了一场“科学复兴运动”

AI前沿成果被科技巨头锁在“黑箱”,欧洲科学家、工程师等发起“科学复兴运动”成立LAION。他们构建开放数据集,训练出表现优异的模型,还进行“爱丽丝梦游仙境”研究测试大模型,探讨推理模型发展方向。

AI科技大本营
开源动态8

字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!

字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。

小华同学ai
产品应用7

一码难求的 Dia 浏览器,有了新进展

Dia 浏览器处于 Alpha 内测,需邀请码体验。测试反馈超预期,将打磨细节发布。其优势是使用 AI 时能方便代入上下文信息,Chat 交互将成主流,Arc 部分功能会融合进 Dia。

MacTalk
新闻资讯8

突发!反噬来了,英伟达限制使用 Anthropic 模型

本文爆料突发AI行业事件:Anthropic发布新模型推出强制数据留存政策,推翻此前和企业签订的零数据保留协议,引发数据安全担忧,英伟达等三家巨头率先限制使用其模型。

AI寒武纪
开源动态8

60000小时炼出新开源VLA!20多种机器人都能用

蚂蚁灵波发布开源VLA模型LingBot-VLA 2.0,用60000小时预训练数据“喂”出。它支持20多种机器人构型,融合LingBot-Depth提升空间理解,还学会预测未来,在GM - 100评测表现佳。

量子位
新闻资讯8

Anthropic 最新播客:如何打造下一代 Claude

Anthropic的Alex Albert上播客揭秘Claude产研流程,涵盖模型规划、用Claude处理反馈、记忆“做梦”机制、性格训练等,还谈及AI对PM工作方式的重塑,以及单向门决策框架等内容。

AGI Hunt
算法论文7

近期,不错的LLM Agent统一记忆框架综述~

随着GPT、Qwen、Claude等大模型能力提升,LLM-based Agent走向长期任务。论文提出统一框架拆解Agent Memory为四组件,围绕两个数据集复现比较10个方法,还设计出新的低token开销框架。

PaperAgent
推荐文章8

以前写书比看书慢,现在看书比写书慢——AI时代最被低估的变局

AI时代信息生产速度超消费速度,这是文明范式转移。过去知识稀缺,现在过剩,多数人应对信息爆炸的方法有误。应从消费信息转为使用信息,这还会重塑教育、社交与社会分层。

AI Reading Hub