「大模型推理系统」共找到 9002 篇相关文章
语义分割别无脑用Argmax!港中文新算法:三行代码,推理速度提升10倍
香港中文大学提出全新算法框架RankSEG提升语义分割性能。传统方法用threshold或argmax生成掩码并非最优,RankSEG无需重训模型,加三行代码就能提高分割指标,还开源了工具包,其改进版RankSEG - RMA推理速度大幅提升。
GPT-5难产内幕曝光!核心团队遭挖空,推理魔咒难破,靠英伟达续命
外媒The Information曝出GPT-5诞生内幕,其未取得技术突破,OpenAI面临数据瓶颈与技术难题,核心研究者被撬导致组织架构混乱。不过,OpenAI获巨额融资,推理模型成突破口,还在开发“通用验证器”。
狂涨26.5K star!一个接口搞定20+AI大模型,开箱即用,太香了!
文章介绍开源项目One API,它是LLM API管理与分发系统,能统一管理主流AI模型,用一个接口搞定调用。有友好界面和可视化操作,在Github获26.5K star,还介绍其性能特色、安装使用方法。
Andrej Karpathy深度解读:强化学习之父为何说大模型违背了「苦涩教训」
Andrej Karpathy深度解读Sutton与Dwarkesh的播客对话。Sutton认为大模型不符合「苦涩教训」,因其训练依赖人类数据集。他追求类似动物通过强化学习与世界交互的系统。Karpathy认可批评,认为找到符合原则算法是突破。
从“卷模型”到“算总账”:AI 产业竞争开始拼什么 | 请回答 WAIC 2026
WAIC 2026热度高涨,InfoQ直播间追问‘AI正在重写什么’。与会嘉宾讨论AI产业新阶段变化,如从‘看能力’到‘算总账’,认为模型重要性方式已变,还探讨了AI原生产品定义、AI Infra影响及未来关注方向。
AI秒懂短视频,快手大模型Keye-VL理解力爆表!技术细节全开源
快手全新多模态大语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。
UC伯克利新作颠覆认知:LLM靠「自信爆表」学会推理?无需外部奖励超进化
UC伯克利华人团队发现,LLM不靠外部奖励,仅靠「自信爆棚」就能学会复杂推理。他们提出基于内部反馈的强化学习(RLIF)新范式,用INTUITOR方法让模型用自身置信度作内在奖励,在多任务中表现良好。
颜水成领衔,给AI分段位!超100款多模态模型,无人达到L5
十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级分类制明确多模态通才模型能力标准。评估超100款模型,发现多数在L2 - L3,无L5模型,揭示当前模型不足。
刚刚,苹果WWDC掀AI重构风暴!端侧模型全开放、AI版Siri却成最大「鸽」王
北京时间今天凌晨,苹果全球开发者大会 WWDC 召开。苹果宣布系列系统更新,展示 AI 融入产品计划,开放端侧大模型,推 Xcode 26。但增强版 Siri 跳票,股价下跌,网友不满。
机器人需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代
2026 WAIC落幕,具身智能成焦点。当前VLA模型在长程任务中有局限,上海创智学院和智元机器人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在长程任务表现出色。