多GPU性能」共找到 5673 篇相关文章

新闻资讯7

新的 Rust 客户端致力于实现基于 Aerospike 的安全、高性能应用

Aerospike正式发布Rust客户端,用于与其实时NoSQL数据库交互。采用异步优先并发模型,支持批命令等。还将支持分区查询等功能,Aerospike也提供其他客户端库助开发者构建应用。

InfoQ
产品应用7

用最简单的大模型技术打造一个迁云专家有难?

文章探讨在云迁移领域用大模型技术“复制”专家80%核心能力。分析标准化方案不足及简单RAG局限,介绍“LX0.1”AI专家助手构建,还提及分层评测、人机协同等优化,最后展望AI在云迁移的未来方向。

阿里云开发者
推荐文章7

性能最高提升7倍?探究大语言模型推理之缓存优化

文章探讨大语言模型推理缓存优化技术演进与未来展望,介绍了主流推理框架vLLM、SGLang,分析KV Cache、Paged Attention、Prefix Caching等技术的优化点,还提及LMCache、DeepSeek的缓存技术,最后提到MCP赋能可视化OLAP智能体应用。

阿里云开发者
新闻资讯7

刚刚,Ilya官宣出任SSI CEO!送走「叛徒」联创,豪言不缺GPU

Ilya现身X发文,自封SSI唯一CEO,Daniel Levy任总裁,此前跳槽Meta的联创Daniel Gross出局。Ilya拒绝Meta 320亿美元收购要约,称专注事业,有算力和团队,要构建安全超级智能。

新智元
7

爆款AI视频越来越,但本质我觉得跟炒股没区别。

作者以AI视频爆款频出为背景,借唐朝张大麻、自身炒股经历等故事,探讨AI视频爆款复制价值、获流量人数及流量后续价值,指出创作应重持续经营,勿盲目跟风。

数字生命卡兹克
推荐文章8

面向工具任务调度的两种路径:MCP vs Agent + Function call

本文围绕大语言模型智能应用中的工具与数据接入问题,介绍了基于 Agent + Function Call 的动态调度机制与基于 MCP 的标准化接入框架,分析了不同场景下的适用性,还探讨了二者未来的协同融合方向。

阿里云开发者
产品应用8

DeepSeek睁开眼了!Opus-4.8的性能,1000张图不到20美分

DeepSeek首个模态视觉模型deepseek-v4-flash-vision-exp上线DeepSeek API平台。文本能力与V4-Flash持平,模态Agent能力逼近Opus-4.8,分析1000张图成本不到20美分,还上线免费Files API。

AIGC开放社区
产品应用8

用嘴聊出来了一个 APP:实测「码上飞」语音开发有离谱

本文实测「码上飞」AI 开发平台,它让用户用对话或语音描述需求,AI 就能做出应用。测试了美甲预约、AI 生图、私域自媒体知识付费小程序三个场景,它表现出色,大幅压缩开发成本,助普通人跨过技术门槛。

特工宇宙
算法论文8

谷歌Jeff Dean和位图灵奖得主合著论文,全面剖析了AI

谷歌Jeff Dean和图灵奖得主John Hennessy等联合发布报告《塑造AI对数十亿人的影响》,拒绝AI极端观点,选择务实。报告剖析打破“饭碗焦虑”、重塑教育医疗等内容,Laude研究所也开展实战评估项目。

新智元
7

图灵奖大佬来听课,竟然只能坐地板!谷歌扫地僧有离谱?

技术圈流传「Jeff Dean Facts」梗图/段子合集,把谷歌首席科学家Jeff Dean捧成传奇。其诞生于2008年,最初是玩笑,后升级为传说。他与Sanjay Ghemawat合作缔造谷歌技术基石,段子折射谷歌工程师文化。

新智元