多GPU性能」共找到 5660 篇相关文章

开源动态7

一周1.2k星!兼具质量与效率的OCR模型MonkeyOCR,支持样化的中英文PDF

MonkeyOCR采用SRR三元组范式,简化工具流程、避免整页文档处理低效问题。与MinerU、端到端模型相比性能更优,处理速度也更快。暂不支持拍摄文档解析,文章还给出安装、推理等操作步骤。

GitHubStore
推荐文章7

端侧跑大模型,现在也太简单了

作者Vicki Boykis分享本地运行AI模型体验,指出如今本地模型性能提升大,像GPT - OSS、Gemma 4系列表现出色。还介绍运行本地智能体流程的设置,虽有问题,但优势,生态值得投资。

机器之心
算法论文8

首个轮LLM Router问世, Router-R1可让大模型学会「思考–路由–聚合」

在大语言模型种类爆炸的时代,如何智能分配任务成新挑战。伊利诺伊大学香槟分校团队发布 Router - R1,让 LLM 学会‘思考–路由–聚合’,用强化学习平衡性能与成本,在七大基准测试表现出色。

机器之心
算法论文7

Mini-Omni-Reasoner:实时推理,定义下一代端到端对话模型

现有端到端对话模型推理能力未解锁,因深度思考带来延迟。为此提出 Mini - Omni - Reasoner,采用边思考边表达范式,突破‘要么快,要么准’困境,还设计了数据合成管线和五阶段训练方法,实验证明其性能提升明显。

机器之心
推荐文章7

一文读懂:数据中心“拥抱”ARM架构,为何如此艰难?

文章探讨企业数据中心采用ARM架构面临的难题。如现有x86架构主导,切换有兼容性问题;ARM硬件选择有限、性能不足;云服务功能难对等;软件支持和许可证问题也阻碍其应用。

芯师爷
算法论文8

大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队等最新研究打破传统认知,揭示‘对齐税’现象。提出置信解码策略,在架构、评测集上表现出色,能绕过‘对齐税’,提升推理准确率,且工程开销低,为大模型发展提供新思路。

量子位
算法论文8

大模型推理学习新范式!ExGRPO框架:从盲目刷题到聪明复盘

上海人工智能实验室等团队提出经验管理和学习框架ExGRPO,能科学管理经验。与传统RLVR方法比,它在不同基准提升性能,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供新思路。

量子位
产品应用7

Google 推出超小杯 AI:Gemma 3 270M!可进手机和浏览器

Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在平台发布,开源策略效果好。

AI工程化
新闻资讯7

1/8成本比肩Claude 3.7,Mistral Medium 3来了

“欧洲OpenAI”Mistral AI发布模态新模型Mistral Medium 3,主打编程和模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。

量子位
开源动态8

文心大模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心大模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新性能表现优。

AI前线