「低延迟推理」共找到 2936 篇相关文章
小模型用不好Skill?新范式让模型学会Skill的底层逻辑,3B模型推理token省5倍,性能反超
浙江大学联合美团龙猫团队、清华大学推出SKILL0,提出技能内化思路。它在训练中引入关键机制,让小模型把技能内化到参数里。实验显示,其效果出色,token效率高,为小模型成领域专家提供新方向。
GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了
GPT-5.2登场,有即时版、思考版与专业版。它在多方面大幅升级,能碾压44类专业工作。经济性强,编程能力佳但速度慢,还自评‘最优科研模型’,幻觉现象减少。今日起推送,优先面向付费用户。
首款推理具身模型,谷歌DeepMind造!自主理解/规划/执行复杂任务,打破一机一训,还能互相0样本迁移技能
谷歌DeepMind发布新一代通用机器人基座模型Gemini Robotics 1.5系列,由GR 1.5和GR - ER 1.5组成,结合视觉、语言与动作,实现“规划 + 执行”闭环,还提出Motion Transfer机制,能跨机器人迁移技能。
RL加持的3D生成时代来了!首个「R1 式」文本到3D推理大模型AR3D-R1登场
强化学习首次被系统性拓展到文本到3D生成领域,上海人工智能实验室等机构研究者提出首个强化学习增强的文本到3D自回归模型AR3D - R1,还提出Hi - GRPO范式和MME - 3DR基准,实验显示其性能优异。
姚班传奇陈立杰入职OpenAI!16岁保送清华,30岁拿下UC伯克利助理教授
最新消息称姚班大神陈立杰加盟OpenAI负责数学推理。他16岁保送清华,30岁成UC伯克利助理教授,长期从事理论计算机科学研究,近期聚焦扩散语言模型。
ICLR 2026 Oral | 告别多步去噪!清华团队推出MVP,实现机器人动作单步极速生成
清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在多任务测试中表现出色。
不写Prompt,连按Tab完成重构:蚂蚁CodeFuse团队提出无指令代码编辑框架NES
在AI coding工具快速演进的当下,蚂蚁集团CodeFuse算法团队在FSE 2026提出无指令代码编辑框架NES。它从历史编辑轨迹学习开发者意图,有双模型架构,实现分三环节,重构交互链路,提升开发者体验。
诺奖获得者Hassabis警告:AlphaGo已觉醒,AGI正接管科研
十年前,AlphaGo击败李世石,让世人看到AI潜力。此后,DeepMind不断推进,其技术从棋盘拓展到科研,如AlphaFold解决蛋白质折叠难题,AlphaProof在数学推理获佳绩,这些成果显示AGI正接管科研。
AutoDev 预上下文引擎:预生成代码语义化信息,构建 AI 编程的知识基座
文章介绍 AutoDev 预上下文引擎,指出向量化代码检索性价比低,提出用预生成上下文提升 RAG 效果。Context Worker 能深度解析代码,支持多语言,使用简单,还可结合 MCP 服务获取上下文知识。
GPT-5或马上现身,神秘Repo出现了其踪迹
OpenAI新推理模型在奥赛夺冠,有人猜测是即将发布的GPT - 5,Sam Altman部分印证,还曾有人在biosec基准库发现其踪迹,但repo已不可见。