CPU运行」共找到 631 篇相关文章

新闻资讯8

让AI自己设计芯片!中国科学院发布「启蒙」,芯片全流程自动设计

近日,中科院计算所联合软件所推出「启蒙」系统,基于AI实现处理器芯片软硬件全流程自动设计,达到或部分超越人类专家水平。该系统在多方面表现出色,如设计的CPU达ARM Cortex A53性能等。

新智元
推荐文章8

Agent 工程师绕不开的必修课:API 网关 vs API 管理

文章探讨了 API 网关与 API 管理的起源发展、关键差异、协同工作及未来趋势。API 网关从流量网关演进到 AI 网关,API 管理从文档化走向商业化。两者差异源于起点、使用角色和技术内核不同,未来将向 AI 网关和 MCP Server 管理演进。

阿里云开发者
新闻资讯8

英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的

9月2日,英伟达技术博客上线《用投机解码做AI模型协同设计》,给出推理加速选型表。列入指南的核心方案多由华人团队主导,介绍了从外置草稿模型到n - gram查表法等方案,还提到硬件常数对模型架构的约束。

新智元
新闻资讯7

刚刚,SpaceX、英伟达宣布:AI数据中心要上天了

SpaceX与英伟达合作设计Starmind AI1卫星计算载荷,每颗卫星搭载NVIDIA GPU和CPU,将数据中心算力部署太空,该设计也用于地面数据中心。但项目投入大,还面临管理集群等难题。

机器之心
开源动态7

AI 还在装失忆?1 万 Star 开源 EverOS 有点东西,把 Agent 记忆塞进 Markdown

EverOS 是 EverMind - AI 开源的项目,有 10325 Star。它给 AI Agent 等提供 local - first 长期记忆运行时,把记忆源头放 Markdown 里,以 SQLite 和 LanceDB 管理和检索。介绍了其优势、链路、适用场景等。

小华同学ai
新闻资讯7

AI 设计9个月就能媲美Blackwell?OpenAI “辣芯”绕开英伟达正面战场,但老黄的GPU大盘不稳了

OpenAI 展示与博通联合打造的定制 AI 芯片 Jalapeño,性能媲美英伟达 Blackwell 或谷歌 TPU。计划年底部署,是多代芯片开发首步。它专为大模型推理设计,设计周期短,成本低,OpenAI 借此扩展全栈能力。

InfoQ
产品应用8

Claude Code 推出 Agent View 功能,一键管理所有会话

Claude Code 推出 Agent View 功能,可同时派出一群 AI agent 干活,在一个屏幕管理所有会话。通过 `claude agents` 命令,能让各会话互不干扰工作,界面按状态分组展示,还能就地回复、随时进出,且后台跑不会断。

AGI Hunt
算法论文8

智能体的尽头是Harness基建!上海交大深度解读Harness

上海交通大学等团队深度拆解智能体技术核心演进逻辑,指出智能体落地关键已转移到外部认知基础设施。阐述记忆、技能、协议与运行环境(Harness)如何重塑概率生成,介绍各模块特点及前沿趋势。

AIGC开放社区
产品应用8

Claude Managed Agents 公测发布!Agent 开发成本直降 500 倍

Claude 宣布 Managed Agents 进入公测,可大幅降低 Agent 开发成本。它能自动生成配置和代码,接管多项任务,实现长时间自主运行。多家早期客户使用后效果显著,还介绍了定价、接入方式及与自建的差异。

AGI Hunt
开源动态7

给 iPhone 装个“最强本地大脑”:Google 开源模型 Gemma 4

Google 4 月初发布开源模型 Gemma 4,可离线运行在 Google AI Edge Gallery 上。它在多项基准表现出色,采用 Apache 2.0 协议,开发者可集成到 App。还介绍了在 iPhone 离线使用方法及适用场景。

MacTalk