多工具推理」共找到 6798 篇相关文章

推荐文章7

图解Vllm V1系列7:使用AsyncLLM做异步推理

文章因异步RL讨论热,探讨用vllm做最小程度异步二次开发。介绍如何用AsyncLLM做异步推理,分析单条请求处理流程及阶段,说明并发提升效率的方法,还提及请求并发及构建异步推理引擎思路。

GiantPandaLLM
算法论文8

强化学习新发现:无需数学样本,仅游戏训练AI推理大增

莱斯大学、约翰斯・霍普金斯大学和英伟达研究团队有颠覆性发现,让模态大语言模型玩简单游戏,无需数学样本,就能显著提升其模态推理能力。提出的ViGaL方法在个基准测试中表现出色。

机器之心
产品应用7

大规模工程支撑场景下的智能体系统设计:Grab 实践案例

Grab分析数据仓库(ADW)团队推出智能体AI系统,处理数据仓库故障排查等工程请求,减少重复性运维。团队搭建智能体架构,整合工具生态,考虑安全治理,解决上下文管理挑战,提升工作效率。

InfoQ
算法论文8

AI读不懂文档结构?计算所重构Agentic RAG文档推理能力

大语言模型工具使用能力推动RAG进化,现有Agentic Search框架有“结构盲”问题。中科院计算所团队提出DeepRead,将文档结构转化为坐标系统,用两大工具协同实现类人推理,在数据集验证效果显著。

新智元
新闻资讯8

突发!OpenAI「掀桌」:自研推理芯片「墨西哥辣椒」跑赢英伟达

OpenAI公布自研推理芯片Jalapeño(墨西哥辣椒)测试结果,它专为大语言模型推理设计,能同时提升吞吐量和降低延迟,在模型测试中超NVIDIA系统。该芯片与Cerebras合作,计划2026年底部署。

机器之心
算法论文8

时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8

在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在任务中表现出色,代码已开源。

机器之心
算法论文8

TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral

大模型推理评测只看答案,忽略推理过程。上海校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
算法论文8

ICCV 2025 | 打造通用工具智能体的基石:北大提出ToolVQA数据集,引领模态推理VQA新范式

北大团队提出ToolVQA数据集,用于提升基础模型工具使用能力。它含2.3万条样本,贴近真实需求。通过ToolEngine构建,涵盖工具与任务领域。微调后模型表现佳,代码与模型已开源。

机器之心
开源动态8

超越GPT-5.2和Gemini-3-Pro!商汤模态搜索、推理模型开源

商汤开源模态自主推理模型SenseNova - MARS(8B/32B双版本),它通过强化学习整合工具,在模态搜索与推理测试中超越Gemini - 3 - Pro与GPT - 5.2,还采用创新算法稳定训练,构建新基准评测。

AIGC开放社区
算法论文8

五倍推理加速,激发自回归潜能,苹果新工作让LLM预测未来

近年来自回归训练方法成语言模型主流范式,但推理阶段计算开销大。苹果研究人员开发框架,让预训练自回归大模型 token 预测,代码和数学任务推理加速达 5.35 倍,一般任务约 2.5 倍。

机器之心