大模型推理」共找到 9477 篇相关文章

新闻资讯7

医疗模型的中国战局:谁在打,打到哪了

中国医药AI赛道已有三家公司上市,是模型赛道唯一跑通商业化闭环的方向。介绍了各梯队企业情况,分析百川智能技术领先但商业化待证明,还对2026年医药AI赛道给出关键判断。

AI Reading Hub
新闻资讯7

让GPT-4.1「头皮发麻的考试」!OpenAI给模型上强度,AI能赢吗?

OpenAI 公布 MRCR 评测标准数据集,其针对 AI 模型上下文能力进行「奥运会」级别测评。MRCR 提升了测试难度,能揭示 AI 能力边界,推动模型发展,帮助更合理应用技术。GPT4.1 在一些测试中表现出色,未来 AI 能力上限充满可能。

新智元
新闻资讯8

马斯克悄然发布Grok 4.1,霸榜模型竞技场所有排行榜

马斯克发布Grok 4.1,同时霸榜模型竞技场第一和第二。它在思考与非思考模式表现出色,还在新专家榜和职业榜霸榜。此外,它在情商测试表现佳,还加强快速回复、改善幻觉问题,已向所有用户开放。

量子位
算法论文7

Meta最新模型RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。

PaperAgent
开源动态8

国产MiroMind智能体框架,登顶全球预测未来模型榜单

国产MiroMind公司在全球首个动态实时预测基准FutureX上夺冠,老板是陈天桥。其开源的MiroFlow v0.2智能体框架优势明显,能升级模型能力,且成本低、可复现。MiroMind在预测赛道领先。

AIGC开放社区
算法论文8

英伟达再出手!新型混合架构模型问世,两创新实现53.6倍吞吐提速

英伟达研究者提出新混合架构语言模型 Jet - Nemotron,在达 SOTA 全注意力模型精度时效率卓越,2B 版性能超 Qwen3 等,H100 GPU 上生成吞吐量最高加速 53.6 倍,基于 PostNAS 和 JetBlock 两创新。

机器之心
产品应用8

小红书提出社交模型RedOne 2.0:兼听、敏行

在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。

量子位
开源动态8

告别Transformer,重塑机器学习范式:上海交首个「类人脑」模型诞生

上海交通学团队发布首个「类人脑」模型 BriLLM,脱离传统 Transformer 架构限制。它基于 SiFu 学习机制,有可解释性、能无限处理上下文等优势,还支持多模态融合,已获交重点项目资助。

机器之心
开源动态8

阿里开源QwenLong-L1:首个以强化学习训练的长上下文推理模型

LRMs扩展到长文本场景是挑战,阿里开源QwenLong-L1框架,是首个用强化学习训练用于长文本推理模型。它含三个核心组件,QwenLong-L1-32B性能领先,与Claude-3.7-Sonnet-Thinking相当。

PaperAgent
算法论文8

一种基于滑动层合并的高效深度修剪模型的方法

文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。

机器学习AI算法工程