GPU架构」共找到 2163 篇相关文章

新闻资讯7

“小龙虾”太多了,CPU告急

当地时间4月9日,谷歌与英特尔宣布扩大多年期合作,部署至强处理器并联合研发IPU。当前AI基础设施瓶颈从GPU向CPU迁移,CPU需求激增但供应紧张,引发产业链连锁反应,其价值重估受多因素影响。

芯师爷
新闻资讯7

想进OpenAI?先解出这道题,百万美元算力已就位

OpenAI发起Model Craft Challenge「Parameter Golf」项目,要求在固定数据集上降验证损失,模型产物控制在16MB内,8张H100 GPU 10分钟完成训练。提供百万美元算力,6月招早期人才,挑战3月18日至4月30日。

机器之心
开源动态8

老黄杀入OpenClaw战场!最强开源「龙虾」模型直逼Opus 4.6

英伟达推出新一代开源模型Nemotron 3 Super,专为大规模AI智能体打造,有1200亿参数,推理快、吞吐量高,性能直逼Claude Opus 4.6等。它解决了Agent应用的难题,还开源了相关数据和训练方法。此外,英伟达还在打造NemoClaw开源AI智能体平台。

新智元
算法论文8

物理AI的「原生」时刻:原力灵机发布具身大模型DM0

主流‘预训练 - 后适配’范式有局限,原力灵机联合阶跃星辰提出具身原生 VLA 模型 DM0。它能统一机器人操作与导航,在 RoboChallenge 测试领先,还介绍了架构、训练方法及未来演进方向。

机器之心
开源动态8

钢铁版OpenClaw,Transformer作者用Rust打造,告别数据裸奔

OpenClaw开源后虽发展迅速,但存在严重安全问题,如数据明文处理、隐私保护缺失、恶意组件等。Transformer论文作者Illia Polosukhin用Rust打造IronClaw,重构底层架构,升级记忆引擎,还指向去中心化经济。

AIGC开放社区
推荐文章7

AI x 大前端性能稳定性:快手亿级 DAU 下的智能诊断实践

本文整理自快手移动端稳定性负责人李锐在 2025 年 QCon 大会的分享。介绍快手大前端性能稳定性挑战,阐述借助「柯南 AI」赋能排障的实践,含根因排障和应急处置案例,还谈了开发中思维切换等认知。

InfoQ
算法论文8

罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!

Meta、OpenAI、xAI联合发表成果CharacterFlywheel,聚焦在生产环境提升社交型AI对话能力。团队基于LLaMA 3.1迭代15个版本,7/8的A/B测试显示正向提升,介绍了架构、数据管道、奖励模型等内容。

PaperAgent
新闻资讯7

OpenAI要跳过5.3,直接迈向GPT-5.4了?

近日,一名OpenAI工程师在公开的Codex GitHub仓库中提交拉取请求,让GPT - 5.4型号出现在代码版本判断条件中,同时有用户发现它曾短暂出现在Codex应用的模型选择器里。线索被迅速修改或删除,引发诸多猜测。

机器之心
开源动态8

Qwen3-ASR的MLX原生实现:让SOTA语音识别跑满苹果芯片

Qwen3 - ASR是强大开源语音识别模型,但官方实现无法充分利用苹果芯片GPU能力。开发者完成MLX重写,让其能在苹果芯片上原生运行,实测性能佳,还有诸多核心功能及安装使用示例。

AI工程化
开源动态7

代码暴减99.9%!独立开发者仅用500行代码做出安全版OpenClaw,GitHub星数狂飙

近日,独立开发者 gavrielc 制作的开源 AI 助手 NanoClaw 火了。它核心代码仅约 500 行,实现 OpenClaw 同等核心功能。相比原版 Clawdbot 代码量大减,还解决了 OpenClaw 安全架构问题,是其安全替代方案。

AI前线