计算量降低」共找到 2034 篇相关文章

开源动态8

DeepSeek-V3.1震撼发布,全球开源编程登顶!R1/V3首度合体,训练暴增10倍

DeepSeek正式上线DeepSeek-V3.1,作为首款「混合推理」模型,将开启智能体新时代。它参数共671B,具强大智能体能力,编程击败Claude 4,训练大幅扩增,在多方面测试表现出色,稳坐编程开源第一王座。

新智元
新闻资讯7

马斯克xAI自研推理芯片曝光!代号X1、台积电3纳米工艺、明年就

马斯克的xAI被曝自研推理芯片X1,用台积电3纳米工艺,2026年三季度产。此前xAI就为自研芯片招兵买马,还将在西雅图设办事处。此外,特斯拉也在推进自研推理芯片。

量子位
开源动态8

NeurIPS 2025 | 中科大、港中深、通义千问联合发布CoRT:仅30个样本教会大模型高效推理,token消耗降低50%

大型推理模型在精确数学计算上存在问题,如认知冲突、行为低效、数据稀缺。中科大、港中深、通义千问联合推出CoRT框架,用创新数据合成与多阶段训练,提升模型推理能力和效率,成果已开源。

机器之心
算法论文7

AMS最新AI4PDE综述:清华大学冯西桥教授团队白金帅等提出面向计算力学中物理和数据引导的AI框架的未来

本文综述人工智能赋能计算力学框架发展与现状,指出纯数据驱动、物理信息神经网络和算子学习方法虽有潜力,但在鲁棒性等方面有挑战。阐述四个研究方向,为复杂物理系统建模等开辟新途径。

力学与人工智能
推荐文章8

模型压缩与化:让大模型走向轻化落地

文章介绍模型压缩与化技术,其能在保持性能时降低大模型计算和存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。

机器学习AI算法工程
新闻资讯7

AI“氛围编程”威胁开源,维护者面临危机

开源维护者正加速关闭外部贡献,因AI生成贡献大质低。研究显示“氛围编程”会造成负反馈循环,降低软件可用性和质。平台激励加剧问题,虽有应对策略但效果不佳。

InfoQ
算法论文8

搜索Agent最新高效推理框架:吞吐翻3倍、延迟降至1/5,还不牺牲答案质丨南开& UIUC研究

大语言模型驱动的搜索智能体有能力但效率低。南开和UIUC研究人员剖析效率瓶颈,提出SearchAgent-X框架,实现吞吐提升、延迟降低,且不牺牲答案质,还揭示AI智能体平衡和等待问题。

量子位
新闻资讯8

吴恩达:并行 Agent是 Scaling laws 的新方向

吴恩达称并行 Agent 是扩展 AI 新方向。过去 AI 靠数据和计算提升能力,如今并行 Agent 能在不增加用户等待时间前提下提升效果,虽任务分解有难点,但研究不断涌现。

AI寒武纪
开源动态7

vLLM 正式支持 PaddleOCR-VL

11月4日,vLLM项目宣布正式支持PaddleOCR-VL模型。该模型专注文档解析,参数仅0.9B。合作降低部署门槛,推理效率更高,官方还给出部署指南和配置建议,流程快速完成可作榜样。

AI工程化
产品应用8

DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈

在NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,在保持性能同时提高长文本处理效率,降低计算复杂度,在多基准测试中表现良好。

CourseAI