推理缓存优化」共找到 3038 篇相关文章

开源动态8

小红书提出DeepEyesV2,从“看图思考”到“工具协同”,探索多模态智能新维度

小红书推出多模态模型DeepEyesV2,它延续视觉推理优势,实现代码执行、网页搜索和图像操作的全工具协同。通过多工具协同推理解决复杂问题,采用两阶段训练策略,准确率远超开源模型。

量子位
算法论文8

LLM的快速、慢速与工具增强思维模式综述

大型语言模型在不同任务中对推理策略需求差异大,策略选择不当会影响效率与可靠性。本文提出双重知识边界框架,梳理LLMs推理模式,将策略选择形式化,还分析了决策因素及策略选择机制。

深度学习自然语言处理
算法论文8

ACL 2025|为什么你设计的 Prompt 会成功?新理论揭示大模型 Prompt 设计的奥秘与效能

英属哥伦比亚大学等团队剖析Prompt在LLM的CoT推理中调控模型内部信息流,构建量化Prompt搜索空间复杂度理论框架。研究解释提示有效的原因,提供设计高效提示词思路,实验验证理论框架。

机器之心
产品应用8

Agnes AI 实测:AI 编程真正的瓶颈,99%的人想错了

本文实测Agnes AI,指出AI编程瓶颈在于缓存命中率,而非模型智商。介绍其产品线、评测成绩与价格优势,还分享客户端体验,包括亮点、回滚事故及日志结论,最后点明智能免费后验证更稀缺。

AI科技评论
新闻资讯7

Claude翻车:Opus 4.1白天退化,Anthropic承认并回滚更新

发布即拿下各项SOTA的Claude Opus 4.1翻车,用户反馈其变得迟钝,官方承认处理某些请求时质量退化,如白天推理性能下降,使用限制不明确,还会暴露API密钥,官方已回滚版本。

量子位
推荐文章8

昇腾MindSpeed:分布式训练加速库的创新实践与突破

在2025年QCon全球软件开发大会上,华为工程师郑加利分享昇腾MindSpeed分布式训练加速库。它在计算、通信、显存等多维度优化,提升训练效率,还介绍业界加速库及MindSpeed架构,阐述多种优化策略。

InfoQ
算法论文7

AI真的能读懂人心吗?阿里通义最新研究成果揭示答案

文章聚焦多模态推理问题,如全局上下文理解不足和推理捷径问题。介绍阿里通义HumanOmniV2改进方案,涵盖全局上下文理解等方面,还详述冷启动、两阶段强化学习训练方案及数据集下载和训练方法。

CourseAI
产品应用8

用AI“打开”金融市场黑盒:微软亚洲研究院如何构建订单级仿真引擎

在大模型与智能 Agent 崛起的时代,金融行业变革不断。微软亚洲研究院刘炜清在 AICon 大会分享,团队构建金融基座模型与 Agent 流程,实现高保真市场模拟与决策优化,还介绍了相关平台和模型构建应用。

InfoQ
开源动态8

碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用能力超强

国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用能力强。测试显示其性能碾压DeepSeek V3等模型,训练流程还有独特技术创新。

AIGC开放社区
新闻资讯8

谷歌TPU杀疯了,产能暴涨120%、性能4倍吊打,英伟达还坐得稳吗?

摩根士丹利研报显示,谷歌TPU产能将爆炸式增长,供应不确定性基本解决。TPU性价比高,在推理领域优势明显,或终结英伟达垄断。文章还给出TPU与英伟达GPU的选择建议及不同利益相关者的应对策略。

机器之心