推理能力提升」共找到 6129 篇相关文章

新闻资讯8

万字实录:VLA 范式,具身智能的曙光与迷雾丨GAIR Live

2025年5月9日,雷峰网等举办“具身智能之VLA的实践与突破”线上圆桌沙龙。多位专家探讨VLA定义、起源、技术路线等,指出其面临推理、数据等瓶颈,还讨论了与强化学习结合、数据选择、提升泛化性、长程任务及落地场景等问题。

AI科技评论
新闻资讯7

快来看看GPT-5第一波实测

GPT-5发布引全球关注,50万粉Youtuber Matthew Berman用25分钟视频展示其近30个任务表现,如做出魔方生成器、复刻网页版Word和Excel等。它多项能力提升,但也有不足,被马斯克质疑,还因‘52>69’名场面遭吐槽。

量子位
算法论文8

3D重建的惊人进展:多所世界名校联合发布论文,告诉你AI在3D世界的研究现状

多所世界名校联合发布调查研究论文,回顾用于3D重建和视图合成的前馈技术并分类,研究关键任务及应用。前馈模型打破每场景优化魔咒,带来速度和泛化能力提升,解锁新应用,但也面临挑战。

AIGC开放社区
算法论文8

AI在线强化学习“边做边学”,斯坦福团队让7B小模型性能飙升,甚至超越GPT-4o

斯坦福等团队提出新范式AgentFlow,由四个智能体组成,用在线强化学习持续提升智能体系统推理能力。以Qwen - 2.5 - 7B - Instruct为基座模型的它在多基准测试表现突出,甚至超越GPT - 4o等大模型。

量子位
算法论文8

小模型大作为!微博的VibeThinker-1.5B超越DeepSeek R1等头部大模型

近年来,“参数越大,能力越强”成行业共识,但带来成本高和资源集中问题。微博AI团队开发的VibeThinker - 1.5B用1.5亿参数和低训练成本,在多项测试中超越头部大模型,还提出SSP框架和MGPO算法。

深度学习自然语言处理
产品应用7

脑子比不过AI,手也要沦陷了?这只灵巧手看得我有点慌

人类手部结构和功能复杂,将其能力复刻到机器人身上是梦想,由此衍生出“灵巧手”方向。但多数“灵巧手”存在不足,世界机器人大会上一款“灵巧手”表现出色。灵巧智能选择柔性传动,其产品DexHand021 Pro优势明显,未来将提升感知和智能水平。

机器之心
产品应用8

DMS Airflow:企业级数据工作流编排平台的专业实践

DMS Airflow 基于 Apache Airflow,集成阿里云 DMS 系统能力,为数据团队提供工作流调度等功能。文章介绍其高级编排能力、DMS 集成特殊能力及使用示例,总结核心优势与适用场景。

阿里云开发者
开源动态7

在 Cache-DiT 框架下实现原生 Serving功能

Cache-DiT 是唯品会开源的 PyTorch 原生 DiT 推理加速引擎,此前聚焦离线推理。现实现完整 Serving 功能,支持单卡与分布式推理模式。文章介绍其实现过程、借鉴 SGLang 的设计,还总结踩坑及使用方法。

GiantPandaLLM
算法论文8

ICML 2025|如何凭「自动补全」实现100K生成3×加速?

在大模型推理复杂的当下,生成超长文本成本高。BIGAI NLCo团队提出推理加速框架TokenSwift,被ICML 2025接收。它重构传统自回归推理,解决长生成瓶颈,在多模型实验中表现亮眼。

机器之心
算法论文8

超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心