吞吐量提升」共找到 2951 篇相关文章

新闻资讯7

马斯克“开大”,600亿重金收购Cursor

SpaceX 宣布将以 600 亿美元收购代码生成初创公司 Cursor,或支付 100 亿美元合作。此前 xAI 编程项目落后,3 月挖角 Cursor 核心人员。Cursor 受竞争压力且缺算力,合作有望提升模型智能水平。交易或影响 SpaceX IPO 估值。

InfoQ
算法论文8

基于DINOv2和SAM2改进的U-Net模型

DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过多尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。

机器学习AI算法工程
开源动态8

多模型共享 GPU 内存,Berkeley 开源新工具

GPU内存利用率低是大模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟化技术让多模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容性好。

AI工程化
产品应用8

字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法

近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其多模态融合出色,还与谷歌 Nano Banana 对比,各有优势。

机器之心
新闻资讯7

OpenAI:我们正朝着什么方向优化 ChatGPT?

OpenAI 官网文章称,ChatGPT 发展方向是成‘对你有用’的工具,不追逐 DAU 或让用户沉迷。它介绍了有用的使用场景,还提及健康使用方面的改进及与专家合作提升响应能力等内容。

特工宇宙
开源动态7

Meta Shuffling的MoE Grouped GEMM kernel benchmark

作者拷贝fbgemm开源的moe grouped gemm kernel,修复小bug后与SGLang的Grouped GEMM Triton Kernel对比,结果显示fbgemm在MoE模型上性能提升显著,可应用到SGLang的ep - moe的grouped gemm kernel中。

GiantPandaLLM
开源动态7

任何错误只犯一次:TencentDB Agent Memory 的团队记忆实践

文章聚焦 TencentDB Agent Memory 的团队记忆实践,从组织协作现状出发,阐述其原理、结构、构建方法,通过多方面测试验证其价值,提炼出设计原则,指出其核心是治理系统,目标是提升协作带宽。

腾讯技术工程
产品应用8

我用 Moxt,开了一家 AI 公司

作者体验 Moxt 后,用其创建 AI 团队做炒股分析、开发产品、设计桌游。Moxt 是 AI 原生协作平台,AI 同事有持久记忆,Workspace 灵活。个人和团队用它能提升效率,实现与 AI 深度共事。

特工宇宙
新闻资讯7

一颗 1.8 纳米芯片,成了英特尔「最后的救赎」

2025年10月9日,英特尔公布基于18A工艺的酷睿Ultra系列第三代处理器Panther Lake。它集成多部件,性能提升大,还将用于机器人等。此前英特尔危机四伏,此产品发布意义重大,成败影响深远。

芯师爷
产品应用8

Anthropic发布Claude Sonnet 4.5:编程能力再登顶,新产品试图颠覆Windows操作系统

今日凌晨Anthropic发布Claude Sonnet 4.5,该版本在编程、计算机使用等能力上显著提升,开放Claude Agent SDK,还推出多项产品功能更新及“Imagine with Claude”研究预览,或对AI编程和Agent产品洗牌。

花叔