在离线混部」共找到 8255 篇相关文章

算法论文7

一篇多模态大模型推理技术最新综述

华东师大&字节跳动系统回顾基于强化学习的MLLMs推理进展,涵盖关键算法设计、奖励机制创新及实际应用,探讨了RLLLMs/MLLMs中的关键设计与优化策略,还涉及多模态大模型推理多方面内容。

PaperAgent
推荐文章7

精打细算虾养成指南: 省 Token 和把 AI 用好,从来就是一件事

文章指出用AI时Token成本高、模型变笨,原因是上下文管理不善。介绍了省Token和用好AI的方法,如按需取上下文、明确约束、多智能体协作、按阶段切换模型等,核心是合适时间将合适上下文装入合适模型。

腾讯技术工程
开源动态8

9.7K Star 把 AI 编码的 token 消耗砍了 16 倍

当前AI编码工具默认读取整个项目文件,token消耗高。code-review-graph项目用Tree-sitter解析代码库成图,追踪改动“爆炸半径”,平均省8.2倍token,技术轻量,还能做社区检测。它揭示AI编码瓶颈信息输入质量。

CourseAI
开源动态8

以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度

近年来大语言模型参数膨胀,成本升高,业界重注小语言模型。近日,Boss直聘南北阁大模型实验室发布仅30亿参数的Nanbeige4 - 3B,多方面媲美甚至超越通义千问Qwen3系列模型,开源印证小模型潜力。

AIGC开放社区
新闻资讯7

特斯拉造出终结者之手!马斯克要挣1000000000000美元

特斯拉股东大会通过近万亿美元高管薪酬方案,马斯克若10年内让市值达8.5万亿美元等,可获奖励。会上展示人形机器人,其明年量产。此外,FSD技术优,还研发AI芯片,虽有反对声,但股东多相信马斯克。

新智元
推荐文章7

AI 时代,编程语言选型更难也更重要:Go、Rust、Python、TypeScript 谁该上场?

AI 写码成常态,编程语言选择更重要。创业者 Armin Ronacher 指出语言权衡需重审,会影响 Agent 代码质量。他认为 Go AI 场景合适,公司绕不开 Python 和 JavaScript。还分析多种语言特点、适用场景及 AI 对编程的影响。

InfoQ
产品应用7

真·博士水平!GPT-5首次给出第四矩定理显式收敛率,数学教授只点拨了一下

数学教授引导下,GPT - 5首次将定性的第四矩定理扩展为带有显式收敛率的定量形式,明确了收敛速率。研究人员还引导其将结果推广到泊松情形,作者起初想将其列为论文共同作者但被 arXiv 政策禁止。

量子位
开源动态8

9B“小”模型干了票“大”的:性能超8倍参数模型,拿下23项SOTA | 智谱开源

智谱发布并开源仅9B大小的模型GLM-4.1V-9B-Thinking,28项评测中拿下23个SOTA,成10B级别最佳VLM模型。它引入思维链推理机制,通过课程采样强化学习提升能力,还获10亿投资。

量子位
开源动态8

Qwen3技术报告首次全公开!“合推理模型”是这样炼成的

本文首次公开Qwen3技术报告,介绍其模型架构、预训练及后训练过程、性能表现等技术细节。Qwen3整合两种模式,引入思考预算机制,降低轻量级模型计算资源,多基准测试领先,多语言支持扩展至119种,所有模型开源。

通义千问Qwen
新闻资讯8

强化学习之父Richard Sutton最新演讲揭示OaK架构:通向超级智能的八步愿景

强化学习之父Richard Sutton演讲中介绍OaK架构,认为它是通向超级智能的路径。他回顾对简单通用AI智能体架构的追求,强调从经验学习、拟合世界的重要性,还指出实现该架构需八个步骤,虽只是愿景但提供了发展路线图。

机器之心