「性能 - 效率权衡」共找到 2920 篇相关文章
微软刚发布Mu模型:支持Windows智能体,小参数跑出10倍性能
今天凌晨微软发布创新小参数模型Mu,3.3亿参数性能比肩Phi - 3.5 - mini,体量小10倍,离线NPU笔记本每秒超100 tokens响应。它支持Windows智能体,架构有多项创新,经训练优化后智能体表现出色。
仅需10%思维链标注,等同全量性能!中科院发布推理监督新范式
中科院计算所团队提出新框架PARO,让模型学习固定推理模式自动生成思维链,只需标注1/10数据就能达全量人工标注性能,适合规则清晰领域,为推理监督提供新思路。
GPT-5难产,外媒爆料:性能提升不大,OpenAI高管Slack上当众破防
GPT-5 迟迟未现身,引发众多传言。外媒爆料其虽有改进,但性能飞跃不如早期 GPT 型号。OpenAI 面临技术问题、组织重组压力等,不过 GPT-5 开发仍有进展,且公司新一轮融资顺利。
OpenAI最新报告曝光!前5%精英效率暴涨16倍,普通人却被悄悄淘汰
OpenAI《企业AI现状报告》基于8亿周活用户和9000名企业员工数据分析得出,企业AI采用率加速加深。报告显示员工用AI提效,工作流重塑,但存在使用差距,前5%精英效率优势明显。
九天大模型大变身:性能狂飙35%!还能一键P大象
7月26日,中国移动在2025世界人工智能大会发布「九天」基础大模型3.0,端到端技术全面升级,复杂推理能力提升35%,智能体调用效率提升21%,还推出代码、数学等专项大模型,多模态能力也焕新。
英伟达成开源新王?Nemotron 3全新混合专家架构,推理效率升4倍
北京时间今天凌晨,英伟达发布 Nemotron 3 系列开放模型,含 Nano、Super 和 Ultra 三种规模。Nano 已上线 Hugging Face,采用混合 MoE 架构,推理效率提升显著。该系列还具备多种核心技术和实用能力,相关工具和数据集也已开源。
传统训练效率很低?我们靠 “给模型降噪” 重新审视长上下文建模难题
文章指出长上下文模型处理长文本时易受噪声干扰,提出新评估指标IG分数和“上下文去噪训练(CDT)”方法。实验表明CDT优于现有策略,经其训练的开源模型在长上下文任务中性能媲美GPT - 4o。
华人学生立大功!新王Mamba-3直击Transformer死穴,推理效率碾压7倍
新一代开源架构Mamba-3发布,由CMU普林斯顿原班人马打造,15亿参数性能比Transformer高4%,长序列任务端到端延迟仅为其七分之一。它采用新设计哲学,推理优先,有三大核心技术,还能与自注意力层混合提升检索能力。
清华等发布UltraRAG 2.0,仅用50行代码解锁RAG高性能开发
大语言模型存在“知识截止”问题,RAG技术应运而生,成为大模型落地主流方案。但随着需求提升,其工程实现变复杂。清华等推出UltraRAG 2.0,仅50行代码实现同等功能,降低开发门槛,性能提升,还能落地多种场景。
性能翻番背后:讯飞与昇腾,如何用国产算力炼就大模型?|甲子光年
在全球AI竞争激烈背景下,科大讯飞与华为昇腾深度合作意义重大。双方合作历经四阶段,实现性能提升与技术突破,还通过软硬件协同构建AI自主发展竞争力,加速大模型行业落地。