多阶段训练」共找到 5953 篇相关文章

产品应用8

揭秘夸克首个高考志愿大模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告

6月12日,夸克发布国内首个高考志愿大模型,上线‘高考深度搜索’等三大核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最大高考知识库,为考生提供精准志愿填报服务。

AI科技大本营
开源动态8

性能大涨!阿里开源新版Qwen3模型,霸榜文本表征

今日凌晨阿里开源Qwen3-Embedding和Qwen3-Reranker两款新模型,专为文本表征等任务设计,支持119种语言。测试显示其性能出色,在语言文本表征和排序任务中超越众模型,还采用了种创新设计与训练方法。

AIGC开放社区
算法论文8

LLM-in-Sandbox:给大模型一台电脑,激发通用智能体能力

来自中国人民大学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让大模型在代码沙盒完成任务,实验显示其能提升领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
算法论文8

MIT & Google | 提出异步并行生成新范式,LLM推理效率大幅提升!

MIT与谷歌团队在研究PASTA中探索异步生成范式,开发标记语言PASTA - LANG,采用双阶段训练流程,设计推理系统。实验显示PASTA平衡性能与质量,有可扩展性,为LLM推理效率优化开创学习驱动新路径。

AINLPer
算法论文7

高效大规模创新3D重建模型iLRM

数基于Transformer架构的模型处理视图输入有可扩展性问题,成均馆大学、延世大学研究人员提出创新3D重建模型iLRM。它通过迭代细化机制生成3D高斯表示,有独特架构设计和高效注意力机制。

AIGC开放社区
推荐文章8

万字长文!大模型(LLM)推理优化技术总结(非常详细)

文章聚焦大模型推理优化技术,介绍推理过程分预填充与解码阶段,还阐述模型并行、注意力机制优化、模型优化及服务技术等,如查询注意力减少内存,FlashAttention 优化计算顺序。

AINLPer
新闻资讯7

新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了

“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最新版Qwen和DeepSeek R1对比。该模型亮点是支持语言推理,以纯RL方式训练,为LLM强化学习提供新范式。

量子位
算法论文8

让LLM扔块石头,它居然造了个投石机

港中大研究团队带来《Agentic Design of Compositional Machines》,推出BesiegeField平台,支持并行实验和大模型‘自我进化’。它将机械设计转为语言生成任务,通过闭环训练提升模型能力,个模型测试表现良好。

量子位
算法论文8

腾讯与中科院联合提出R-4B,一个能自动决定是否思考的模态大模型

模态大语言模型“始终思考”模式有缺陷,腾讯混元团队与中科院自动化所联合提出R - 4B,通过双模式退火训练和双模式策略优化实现自动思考,在评测中达SoTA,省资源且效果好。

深度学习自然语言处理
算法论文8

Meta新突破!跨模态生成告别噪声:流匹配实现任意模态无缝流转

Meta与约翰霍普金斯大学联合推出CrossFlow框架,实现跨模态生成新突破。它基于流匹配提出新范式,无需依赖噪声分布等,在任务上媲美或超最优算法,训练成本低、速度快,还能适配任务。

机器之心