在离线混部」共找到 8185 篇相关文章

开源动态7

DeepSeek推理再提速80%,V4正式版定档7月中旬

DeepSeek两天前开源DSpark推理加速框架,已V4预览版线服务跑真实流量,使生成速度提升60% - 85%。DSpark化解推测解码问题,多模型超Eagle3和DFlash。V4正式版7月中旬上线,将引入峰谷定价。

AIGC开放社区
产品应用7

别再幻想 Vibe Coding 打天下,AI 编程最实用的功能是这个

OpenAI 创始成员 Andrej 起初提出 Vibe Coding,后改变观点,称应让不同工具不同场景各司其职,且其常用 AI 编程功能是代码补全。字节跳动 IDE Trae 里的 Cue 功能代码补全领域下足功夫,体验出色。

MacTalk
开源动态8

升级版Qwen3开源模型深夜来袭,超越Kimi-K2、DeepSeek-V3

深夜阿里千问推出 Qwen3-235B-A22B-Instruct-2507-FP8 版本。新模型通用能力显著提升,多测评中表现出色,超 Kimi-K2 等模型。还增强多语言知识覆盖等性能,已魔搭和 HuggingFace 开源。

机器之心
推荐文章7

重新思考 AI TCO:为何每 Token 成本才是唯一重要的指标

生成式与代理式AI时代,传统数据中心转变为AI Token工厂,企业评估AI基础设施时不应只关注算力成本、每美元FLOPS,而应重视每Token成本,它决定AI规模化盈利,NVIDIA该指标上表现出色。

AI前线
算法论文8

港大×复旦×上交:视触觉融合+闭环纠错,让机器人双臂协作不再「盲操」

港大联合复旦、上交大提出TAMEn,UMI框架上全方位升级,构建视触感知融合等数据闭环,打通数据采集到再训练链路。其三层闭环让机器人学得更快准高效,双臂协作任务中提升成功率。

量子位
算法论文8

何恺明带大二本科生颠覆扩散图像生成:扔掉多步采样和潜空间,一步像素直出

何恺明团队提出新方法Pixel Mean Flow(pMF),突破传统扩散模型/流模型限制,砍掉多步采样和潜空间,一步像素空间生成图像,ImageNet不同分辨率上取得佳成绩,还介绍了核心设计、实验结果对比等。

量子位
新闻资讯7

真实音频场景,大模型集体挂科!首个原生语音基准MultiChallenge

Scale AI发布首个原生音频多轮对话基准Audio MultiChallenge,撕开大模型靠合成语音评测维持的假象。实验显示,Gemini 3 Pro等模型真实场景表现不佳,还揭示了模型语音交互中的三大失败模式。

新智元
开源动态7

Rex-Omni:用 3B 模型颠覆目标检测

长期目标检测依赖传统坐标回归模型,MLLMs方法存不足。IDEA研究院提出30亿参数的Rex - Omni多模态大模型,零样本测试中表现超现有回归模型,还具备丰富语言理解能力,有独特设计和训练流程。

带你学AI
新闻资讯7

GPT-5几个预测:用户翻倍,编程登顶,屠杀一众模型

OpenAI发布GPT-5,登顶大模型测评榜单。它有统一智能架构,多测试取得突破,编程能力强击败对手。还改进意图,减少幻觉、增加情感、健康领域更实用,价格便宜。作者预测其将带来用户翻倍等影响。

鲸选AI
新闻资讯7

谷歌 DeepMind 发布机器人学基础模型 Gemini Robotics On-Device

谷歌 DeepMind 推出 Gemini Robotics On-Device,这是视觉 - 语言 - 行动基础模型,可机器人硬件本地运行,低延迟且能针对特定任务微调。它是 Gemini Robotics 家族最新迭代,还发布相关基准测试。模型待广泛可用,SDK 可 GitHub 找到。

InfoQ