高效推理框架」共找到 3696 篇相关文章

算法论文8

绝对零监督Absolute Zero:类AlphaZero自博弈赋能大模型推理,全新零数据训练范式问世

清华大学 LeapLab 团队等提出全新推理训练范式 Absolute Zero,使大模型实现「自我进化式学习」。基于此范式训练的模型 AZR,在代码生成与数学推理基准任务表现出色,缓解了大模型对人工数据依赖难题。

机器之心
产品应用8

当AI开始重写自己:EverMind的自进化智能体框架Raven,正在定义数字生命的下一个形态

机器之心发布文章,介绍 EverMind 基于自研记忆系统 EverOS 发布自进化 Agent 框架 Raven。阐述其研发背景,指出传统 AI 无状态问题。还讲了 EverOS 特点、数字生命演进四阶段,以及 Raven 技术逻辑、对用户和开发者的价值等。

机器之心
算法论文8

链式思维是幻象吗?从数据分布视角重新审视大模型推理,马斯克回复,Grok破防

亚利桑那州立大学研究发现,思维链(CoT)推理可能只是对训练数据分布内模式的复现,输入与训练数据分布有差异时,推理链条会失效。研究探究了CoT泛化性等问题,对实际应用提出警示。

机器之心
开源动态8

机器人进入“边做边学”时代:星尘发布在线强化学习框架,让动态投掷成功率提升超141%

星尘智能基座模型团队公布在线强化学习框架SmoothRL,解决异步执行环境中具身模型在线微调难题。该框架让策略更新对应硬件实际执行,攻克延迟失准问题,在多项真机测试中大幅提升任务成功率。

AI前线
开源动态8

弃 Python 拥抱 JVM,Spring 之父 20 年后再造“革命性框架”:我从未如此确信一个新项目的必要性

Spring 之父 Rod Johnson 开源专为 JVM 生态设计的 AI 智能体框架 Embabel,旨在弥合生成式 AI 的‘承诺’与‘现实’差距。它采用 GOAP 方法保证确定性,有弹性执行与动态重规划能力,还引入多种机制确保可控性与安全性。

InfoQ
开源动态8

Token洪流的转向:当AI Agent成为Token消耗的主宰,什么样的推理服务基础设施才是刚需

Token消耗量转移,AI Agent成Token消耗主宰,大模型推理服务底层逻辑重塑。文章介绍AI Agent时代范式转变、对推理基础设施的需求,还阐述了为其打造的AI Serving Stack架构及优势,它获2025年度相关卓越奖。

AI前线
算法论文8

给大模型「持续注入新知识」,北航CASE框架:编辑千次不失忆,额外参数不到1MB丨WWW'26

北航团队提出CASE框架解决大语言模型持续吸收新知识难题。该框架给编辑“算分”、调“关键神经元”,破解核心痛点。实验显示,1000次编辑后准确率提升近10%,额外参数不到1MB。

量子位
算法论文8

CJA | 中国航天气动院冯亦葳、许亮等:符号回归启发的可压缩流场结构智能识别:基于局部对流特征分布的统一理论框架

目前流场结构识别方法有局限,传统经验法依赖阈值,深度学习法可解释性与泛化能力不足。本研究从流体控制方程出发,用符号回归建立统一流场结构分类框架,能准确识别复杂流动结构。

力学与人工智能
算法论文8

POF | 西交大陈泽伟、陈刚等:面向可变形域非周期非定常流动的几何自适应时空深度学习框架

西交大陈泽伟、陈刚等人提出ViT - STFlowNet框架,用于可变形域非周期非定常流动预测。该框架融合自适应网格变换与ViT架构,克服传统方法局限,测试显示预测精度高、泛化能力好,为飞行器流场感知控制提供工具。

力学与人工智能
新闻资讯7

马斯克xAI自研推理芯片曝光!代号X1、台积电3纳米工艺、明年就量产

马斯克的xAI被曝自研推理芯片X1,用台积电3纳米工艺,2026年三季度量产。此前xAI就为自研芯片招兵买马,还将在西雅图设办事处。此外,特斯拉也在推进自研推理芯片。

量子位