大模型推理」共找到 9477 篇相关文章

开源动态8

SGLang原生支持昇腾,新模型一键拉起无需改代码

12月20日SGLang AI金融π对收官,聚焦大模型推理效率。昇腾成SGLang原生支持后端,助DeepSeek等模型免调参运行。SGLang给出推理系统工程解法,昇腾与SGLang深度共建,性能优且全面拥抱开源。

量子位
算法论文8

华为新架构砍了Transformer动脉!任意模型推理能力原地飙升

即便Transformer是AI世界基石,但遇到复杂数学题或多步逻辑推理时表现不佳。问题出在Attention机制。华为诺亚方舟实验室推出Nexus高阶注意力机制架构,能提升模型推理能力,且参数零增。

量子位
开源动态8

清华团队开源发布首个结构化数据通用模型

2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用模型。它融合结构因果推断与预训练技术,适配多任务,性能超最优专用模型,已落地多个工业场景。

AI科技评论
新闻资讯8

Manus数十亿美元卖身Meta,智谱夺得全球模型第一股

2025年末中国AI领域有两喜事,通用AI Agent公司Manus被Meta数十亿美元收购,其发展迅速成果显著;智谱启动招股,即将成为全球模型第一股,虽研发投入高,但营收增长快,获资本青睐。

AIGC开放社区
产品应用7

神秘模型象」:仅100B拿下SOTA,Token效率超高!

神秘模型象」面纱揭开,它出自蚂蚁Inclusion AI团队,仅100B小,是同规模SOTA且省Token。经多方面实测及权威榜单评测,它快、准、省,能胜任多数日常工作,但也有不擅长的领域。

量子位
新闻资讯7

AI时代已来,魔幻的模型投毒事件,我们怎么应对?

央视315晚会曝光针对模型的蓄意信息围猎,虚构手环经力擎系统包装成科技尖货。黑产靠此吸金,利用技术污染证据链。多方已行动,厂商需提升安全能力,消费者要保持警惕。

AIGC开放社区
新闻资讯8

DeepSeek-R2尚未问世,微软小模型捡漏称王?6000样本炼出「数学作弊器」!

微软推出Phi-4推理模型系列,参数最多14B,能在本地高性能笔记本电脑上流畅运行。Phi-4-mini-reasoning在数学推理上性能超越DeepSeek-R1蒸馏模型,且参数规模更小。文章还介绍了模型特点、训练方法、性能表现及局限性等。

新智元
开源动态8

香港中科院发布聆音模型,400万张图喂出个“AI超声神医”

中国科学院香港创新研究院发布超声模型“聆音”,用超400万张图像的超声数据集,经自监督学习训练。它在多项诊断任务破纪录,临床效果佳,还将模型等开源,有望推动领域发展。

AIGC开放社区
开源动态8

猛涨25k star!一键检测你的电脑能跑哪些模型

最近 Github 出现工具 `LLMFit`,用 Rust 编写,能自动检测硬件配置,判断模型能否流畅运行,推荐最优量化版本和运行模式。有一键硬件检测等特性,安装使用方便,降低本地部署门槛。

开源先锋
算法论文8

极简RL新范式:一半算力刷新1.5B模型推理SOTA

过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型上刷新SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。

深度学习自然语言处理