在离线混部」共找到 8177 篇相关文章

开源动态7

强化学习+MCP=王炸?开源框架教AIMCP中玩转工具解决任务,实测效果超越GPT!

科技公司OpenPipe提出全新开源强化学习框架MCP·RL,只需一个MCP Server地址,agent就能自动发现工具、生成任务,闭环反馈中摸索出最优调用策略,实测2/3的benchmark上达或超SOTA性能。

量子位
新闻资讯8

老黄CES 2026 上预言:将要告别应用软件的预编译时代,未来的应用是 GPU 上实时生成每一个像素

黄仁勋CES 2026预言,应用将告别预编译时代,GPU上实时生成像素。他回顾2025年AI关键进展,介绍Agentic AI特点与能力,还谈了其搭建及应用前景,指出未来软件或基于Agent交互。

宝玉AI
新闻资讯8

黄仁勋 GTC 2026 演讲实录:所有SaaS公司都将消失;Token成本全球最低;“龙虾”创造了历史;Feynman 架构已路上

北京时间2026年3月17日,英伟达CEO黄仁勋GTC演讲,展示AI“全家桶”。他回溯CUDA 20年,介绍数据处理新软件库,还提及AI原生企业爆发、Token成本优势、Vera Rubin平台等,强调英伟达AI领域的全面布局。

AI前线
新闻资讯8

100个产品原型同时跑、新模型Mythos断层领先,连skills效果都好到让团队意外:Anthropic内部到底发生什么?

Claude Cowork 工程负责人 Felix Rieseberg 播客中透露,未发布的新模型 Mythos Preview 带来“断层式跃迁”,安全漏洞检测等方面表现出色。Anthropic 内部可同时跑上百个产品原型,执行成本降低。还介绍了 Cowork 开发、应用及产品打造经验。

InfoQ
开源动态7

DeepSeek研究员1200行代码复刻vLLM,H800硬件实测性能反超原版

DeepSeek研究员俞星凯搞出开源项目Nano - vLLM,仅用不到1200行代码实现最小化且完全可读的vLLM。它有快速离线推理、代码可读性强、含优化套件等特点,H800硬件实测中性能反超原版vLLM。

量子位
算法论文8

破解线长时序重建难题!纯视觉、单卡实时的公里级流式3D重建|CVPR'26

自动驾驶等领域,长序列3D重建落地难,存精度退化等问题。即将到来的CVPR 2026中,LongStream模型开源,它重新设计,解决了长序列难题,多基准测试表现强,推动3D视觉走向线建模。

量子位
新闻资讯8

微软刚发布Mu模型:支持Windows智能体,小参数跑出10倍性能

今天凌晨微软发布创新小参数模型Mu,3.3亿参数性能比肩Phi - 3.5 - mini,体量小10倍,离线NPU笔记本每秒超100 tokens响应。它支持Windows智能体,架构有多项创新,经训练优化后智能体表现出色。

AIGC开放社区
开源动态8

开源仅一周,鹅厂文生图大模型强势登顶,击败谷歌Nano-Banana

腾讯元团队开源的原生多模态生图模型元图像 3.0,开源仅一周就国际权威评测榜单 LMArena 上超越谷歌 Nano - Banana 等,位列文生图综合和开源榜单第一。实测表现出色,技术上也有诸多创新。

机器之心
算法论文8

刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习

腾讯元团队和复旦联合团队发布姚顺雨署名首篇论文《CL - bench》。论文证实模型上下文利用上有能力短板,还构建了CL - bench评测基准,评估发现前沿模型上下文学习上表现差,未来要让上下文学习走向现实。

机器之心
新闻资讯7

3B小模型,编程得分比肩Opus 4.5,神秘模型引发热议,原是国产

最近,3B小模型VibeThinker - 3BX上火了,它编程等推理任务上比肩前沿大模型,体积却小很多。它是国产模型,来自新浪微博团队,各项基准测试表现出色,不过通用知识领域表现欠佳。

机器之心