推理与计算」共找到 7989 篇相关文章

新闻资讯7

性能翻番背后:讯飞昇腾,如何用国产算力炼就大模型?|甲子光年

在全球AI竞争激烈背景下,科大讯飞华为昇腾深度合作意义重大。双方合作历经四阶段,实现性能提升技术突破,还通过软硬件协同构建AI自主发展竞争力,加速大模型行业落地。

甲子光年
开源动态8

即将开源 | 阿里云Tair KVCache Manager:企业级全局 KVCache 管理服务的架构设计实现

阿里云Tair KVCache团队联合多团队将开源Tair KVCache Manager,介绍其架构设计实现。该服务应对Agentic AI下KVCache存储挑战,解决传统模式难题,具备企业级管理能力,后续还会完善多方面功能。

阿里云开发者
新闻资讯8

英伟达斥资50亿美元联手英特尔,将开发AI基础设施和个人计算产品

英伟达斥资50亿美元入股英特尔,双方将联手开发AI基础设施和个人计算领域定制化产品。合作聚焦数据中心和个人计算,是长期战略联盟。公告发布后,英特尔股价涨超26%,AMD股价跌超3%。

AIGC开放社区
新闻资讯8

GAIR 2025 大会首日:AI重构教育、科学产业的十三重碰撞

2025年12月12日,第八届GAIR全球人工智能机器人大会在深圳开幕。众多顶级学者围绕AI对教育、产业等领域的影响发表演讲讨论,如赵伟院士提出高校“加减替换”培养模式,贾佳亚教授认为大模型将走向“感知机器+终身学习”模式等。

AI科技评论
开源动态7

DeepSeek R1/V3作者开源轻量级vLLM,1200行代码读懂大模型推理技术!

DeepSeek R1/V3作者俞星凯开源轻量级vLLM——Nano - vLLM。它有快速离线推理、代码可读、含优化套件等特性,还给出了RTX 4070等硬件和Qwen3 - 0.6B模型的基准测试配置。

PaperAgent
算法论文8

满分的「差」,Qwen复旦等揭示编程智能体奖励设计的结构性困境

Qwen团队复旦等联合发表论文《The Verification Horizon: No Silver Bullet for Coding Agent Rewards》,指出编码智能体奖励设计存在结构性困境,任何奖励信号只是人类意图的‘替身’,验证需成系统智能体协同演化,并研究多种验证者。

机器之心
开源动态8

史上最大高质量科学推理后训练数据集开源,快速让Qwen3等变“科学家”

上海创智学院、上海交通大学发布开源科学推理后训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。

量子位
算法论文8

EasyCache:无需训练的视频扩散模型推理加速——极简高效的视频生成提速方案

近年来,扩散模型在视频生成领域广泛应用,但推理慢、算力消耗高问题突出。EasyCache是无需训练的视频扩散模型推理加速方案,在多模型实验中实现大幅提速且视频质量几乎无损,为技术落地提供基础。

机器之心
新闻资讯7

小米小爱同学:资源受限下,实现端侧大模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,了解其团队在资源受限的端侧设备实现大模型高性能推理的策略。目前端侧大模型商业化落地慢,团队提前布局,自研框架,实现超180 tokens/s推理速度,还分享未来突破方向。

InfoQ
开源动态8

开源Qwen一周连刷三冠,暴击闭源模型!基础模型推理编程均SOTA

通义千问卷疯了,Qwen3-Coder刚登场,全新开源Qwen3系列最强推理模型Qwen3-235B-A22B-Thinking-2507又刷新SOTA。一周内,通义千问完成开源三连,在基础模型、编程模型、推理模型方面均达全球开源最强。

量子位