大模型训练」共找到 9479 篇相关文章

新闻资讯7

AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊

图像推理现新难题,在Reddit引发热议,目前无AI能真正解决。国内外支持图像输入的模型答案不同,原因是对立方体规格理解不同。结合提示多次尝试,部分模型能找准方向,人类面对该问题也会困惑。

量子位
新闻资讯7

突发!微软与OpenAI同日开火:语音之战+通用模型,AI霸权决战打响

OpenAI发布语音模型时,微软同日推出自研语音模型MAI-Voice-1和通用模型MAI-1-preview。MAI-Voice-1效率高、表达丰富,MAI-1-preview采用MoE架构。微软此举在语音战场布局,也为与OpenAI谈判增加筹码。

新智元
算法论文8

超越对数似然:模型能力连续体下的监督微调新范式

论文挑战监督微调(SFT)用负对数似然(NLL)作训练目标的默认设定,提出基于概率的目标家族,引入“模型能力连续体”概念,分析不同目标在不同模型能力下的表现,为模型训练提供新优化方向。

深度学习自然语言处理
算法论文8

Scaling Law再现Agent领域!阿里提出训练新范式:在预训练和后训练之间还需一个Agentic CPT

近年来,型语言模型向智能体系统进化。但当前主流方法构建智能体不佳,阿里通义实验室团队论文提出智能体持续预训练(Agentic CPT)新范式,开发AgentFounder模型,在多基准测试表现卓越。

深度学习自然语言处理
新闻资讯7

哈萨比斯出的难题,GPT之父接上了:用一个知识停在1930年的模型

GPT之父Alec Radford等用1931年前数据训练13B模型Talkie,切断现代知识污染。研究者测试其能力,探讨它对未来的“预感”、规避污染问题及数据多样性等,同时训练中也面临时间泄漏、数据质量等难题。

机器之心
算法论文8

工行x上交发布多智能体研究成果,通过群体智能刷新翻译新高度!

2025年多智能体系统成模型研发新高地。工行数据和人工智能实验室与上海交人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
开源动态7

开源多模态模型EarthMind,观测地球统一框架

地球观测数据复杂,现有多模态模型难适用。意利、德国多所高校研究人员联合开源多模态模型EarthMind,引入空间注意力提示模块,实现跨模态融合和多粒度理解,解决地球观测难题。

AIGC开放社区
算法论文8

英伟达笑到最后!训练2000步,1.5B逆袭7B巨兽,Scaling真来了

英伟达团队提出ProRL训练法,将强化学习扩展到超2000步。用此方法训练的15亿参数模型媲美70亿参数的Deepseek - R1 - 7B,在多任务中表现出色,解决了熵崩溃和训练不稳定问题。

新智元
开源动态8

更高智商更快思考!蚂蚁开源最新万亿语言模型,多项复杂推理SOTA

蚂蚁正式发布拥有万亿参数的通用语言模型Ling-1T,超越多个开源和闭源模型,在多项复杂推理基准中取得SOTA表现。它推理和代码能力强,研发采用‘中训练+后训练’,还提出新奖励机制和LPO方法。

量子位
算法论文8

700万参数击败DeepSeek R1等,三星一人独作爆火,用递归颠覆模型推理

今年6月Sapient Intelligence提出的HRM影响模型推理结构,四个月后三星研究员Alexia Jolicoeur - Martineau推出TRM,700万参数模型在推理基准测试中超越参数多10000倍的模型,还介绍了TRM原理、改进及实验结果。

机器之心