推理硬件」共找到 2478 篇相关文章

开源动态8

Thinking Machines 发布又一神作「在线策略蒸馏」 ,LLM后训练效率飙升50-100倍

Mira的THINKING MACHINES开源「在线策略蒸馏」LLM后训练方法,结合两种主流后训练范式优点,提升训练效率50 - 100倍,成本降低9到30倍,可用于数学推理、模型个性化等场景。

AI寒武纪
新闻资讯8

李飞飞的创业公司放大招:只要一个 H100 就能跑世界模型

“AI 教母”李飞飞的创业公司 World Labs 推出高效世界模型 RTFM,只需一个 H100 GPU 就能一边和用户交互,一边实时渲染 3D 世界,显著降低硬件成本和部署难度,渲染效果也不俗。

InfoQ
推荐文章7

GPT-5 核心成员详解 RL:Pre-training 只有和 RL 结合才能走向 AGI

本文编译 OpenAI 研究副总裁 Jerry Tworek 访谈,探讨 RL 与通向 AGI 路径。他认为 pre - training 与 RL 需结合,GPT - 5 是 o3 迭代,还谈及推理、模型发展、训练方式及 OpenAI 研究情况等。

海外独角兽
产品应用7

对话「闪念贝壳」创始人 Ping:用 AI 抓住灵感消散前的 3 秒

本文是对闪念贝壳创始人 Ping 的访谈。他讲述创业初心,介绍闪念贝壳这款语音记录笔记产品,称其与传统笔记不同,更注重驱动思考和行动,还分享用户案例、谈竞品及硬件计划等。

特工宇宙
新闻资讯3

马斯克Grok 4正式发布:世界最大AI超级计算机就训练了这?

Grok 4公开基准测试有进步,但在高级推理测试表现差,视觉理解仍是短板。性能提升多靠整合符号工具,无重大技术创新,‘幻觉’问题没实质进展,xAI官方对道德对齐信心不足。

AI寒武纪
开源动态8

清华SageAttention3,FP4量化5倍加速!且首次支持8比特训练

清华大学陈键飞团队提出针对BlackWell架构的SageAttention3,实现5倍于FlashAttention的推理加速,首次支持8比特训练。在多种大模型上保持端到端精度,代码将分别于6、7月开源。

机器之心
新闻资讯8

5轴联动直插大脑!马斯克大招:90亿美元估值,20余人已植入

Neuralink手术机器人进化到第二代,5轴联动可直插大脑深处,8个摄像头与OCT系统助其避开血管。已在20名真人大脑手术,提速11倍。目标打造通用神经接口,虽硬件先进,但对大脑理解不足成瓶颈。

新智元
7

向黄仁勋汇报的英伟达36人

文章曝光向英伟达CEO黄仁勋汇报的有36人,分属七个职能板块。硬件是基石,AI等成“第二支柱”,还需系统化对外沟通机制,文中介绍关键将领,也谈及管理模式变化及高压文化。

量子位
新闻资讯7

对话逐际动力张巍:造机器人很容易,关键是用起来

量子位对话逐际动力创始人张巍,他表示人形机器人本体硬件制造容易,难点在大脑和小脑AI化能力。逐际动力要做技术平台,降低开发门槛,目标是让天下没有难落地的机器人。

量子位
新闻资讯7

GPT-5:我更强了,就这?“看不见”的升级

OpenAI 发布 GPT - 5,它未带来 AGI 相关的震撼升级,而是更注重实用。其训练有新特点,具备推理强、编程能力提升等特性,是 AI 从‘模型炫技’到‘产品体验打磨’转变的标志。

MacTalk