推理算力」共找到 2708 篇相关文章

算法论文8

突破视觉-语言-动作模型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知

视觉 - 语言 - 动作模型(VLA)在机器人操控领域潜力大,但应对长时序或精细操作任务时性能下降,根源是缺乏三维空间感知与推理能力。中国科学院自动化研究所与灵宝 CASBOT 提出 QDepth - VLA 模型,提升了机器人空间推理与操控精度。

机器之心
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。

DeeplearningAI
新闻资讯7

OpenAI 广告续命遭全网骂,用户要跑路 Gemini!需烧 400 亿,18 个月破产预警

OpenAI 计划在 ChatGPT 对话界面测试广告投放,引发社区热议,批评居多。此举是为拓展营收,缓解成本压力。其算力投入与营收均大幅增长,但仍面临算力缺口,加入广告坚守三大原则,不过有预测称其 18 个月内或破产。

InfoQ
产品应用8

全球首个英伟达含量为0的万亿模型,成了海外开发者的抢手货

美团推出LongCat-2.0,是首个在国产算力上实现全链路训推闭环的万亿参数模型。它多项性能强,适配主流编程工具,架构设计原创,还证明了国产算力有支撑大模型迭代的能力,训推成本更低。

量子位
推荐文章7

AI产业链投资大逻辑:第五集

本集围绕AI产业链算力服务层中云的故事展开,探讨在AWS等超大规模云厂商主导市场下,为何还会冒出新型AI云公司且获高估值。过去十五年云计算市场由巨头主导,2023年后,其自身算力不足使市场结构出现裂缝。

newtype AI
算法论文8

Reasoning的最终答案可能不是模型想要的答案!

大型语言模型解决复杂问题有推理过程和答案,传统评估只看最终答案。论文提出最终答案可能不佳,中间步骤更值得研究。还介绍通过切割推理过程发现中间步骤藏玄机,提出‘分步检查法’提升模型表现,实验表明准确率最高提升13%等。

深度学习自然语言处理
算法论文8

腾讯发布SpecExit算法,无损压缩端到端加速2.5倍!解决大模型长思考效率难题

腾讯发布 SpecExit 算法,将思考早停与投机采样融合,利用轻量级草稿模型预测“退出信号”,在不引入额外探测开销的前提下,实现动态、可靠的思考早停,在 vLLM 上推理端到端加速 2.5 倍,准确性和推理效率得到双重保障。

机器之心
新闻资讯7

DeepSeek流量暴跌?AI大模型全球霸主离奇遇冷,外媒曝出真相

曾以低价高性能出圈的DeepSeek,在自家平台遇冷、市场份额下滑,但其R1和V3模型在第三方平台使用量增长近20倍。背后是‘Token经济学’及战略转移,它开源模型,将算力留作研发。Anthropic也因算力受限有类似问题。

新智元
算法论文8

破解AI对不同上下⽂位置的敏感度不⼀致,新框架使出“解铃还须系铃人”

语言模型存在位置偏见,影响复杂推理等任务。论文提出Pos2Distill框架,将模型优势位置能力迁移到劣势位置缓解偏差,设计了Pos2Distill - R1和Pos2Distill - R2,在检索和推理任务表现好且有跨任务泛化能力。

量子位
推荐文章8

构建会“说话”和“行动”的 AI:生成式数字人技术与 EchoMimic 实践

在 QCon 全球软件开发大会上,支付宝李宇明围绕 EchoMimic 介绍生成式数字人进展、技术、应用及研究思路。对比传统数字人,生成式数字人成本低、易控制,但也有技术新、推理成本高的问题。EchoMimic 两版本已开源,经优化推理速度可提升。

InfoQ