低算力需求」共找到 2327 篇相关文章

新闻资讯8

英伟达通用机器人芯片来了:AI算力提升7.5倍,宇树、银河通用已搭载

本周一,英伟达发布新一代机器人专用芯片Jetson Thor,算力是上一代7.5倍,能效3.5倍,内存容量翻倍。适配新算法,支持多种模型,已受大量厂商重视,相关产品已发售或开放预订。

机器之心
产品应用8

医疗幻觉率比DeepSeek3倍,百川循证增强大模型横扫全球医学考试!

百川智能发布首个循证增强医疗大模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率,多国医考成绩优异,已上线百小应APP并开放API。

新智元
新闻资讯7

奥特曼刚刚发文,10GW核爆级算力!每周一座核电站,五座新城官宣

继英伟达千亿投资OpenAI后,「星际之门」官宣新增五个站点,预计年底前达成10GW目标。奥特曼发文称要打造每周GW级「AI工厂」,认为AI无限算力或可治愈癌症。

新智元
新闻资讯7

马斯克要自己做「英伟达+台积电」!宇宙芯片宏图开工,算力产能扩5000%

马斯克宣布启动史上最大规模芯片计划Terafab,目标是每年生产超1太瓦算力,80%部署至太空。该计划将芯片设计到制造整合,为机器人、AI和太空数据中心造芯片,不过暂无具体时间线。

量子位
新闻资讯7

安谋科技Arm China闪耀2025全球计算大会|赋能绿色算力,加速AI普惠

安谋科技Arm China受邀出席2025全球计算大会,参与多项活动。深度参与撰写《算力经济绿色研究发展报告》,推进本地化标准建设,还在具身智能领域发力,其“周易”NPU IP将助力具身智能落地。

芯师爷
算法论文7

中移动九天团队MultiPL-MoE:全新Hybrid-MoE架构用于增强通用大模型资源代码能力

大语言模型在有限计算资源下提升多语言代码能力面临挑战。中国移动九天团队提出 Hybrid MoE 架构 MultiPL - MoE,耦合两层专家选择机制优化,实验证明其在增强资源代码能力、缓解高资源语言遗忘上有效。

机器之心
开源动态7

刚刚,马斯克开源基于 Grok 的 X 推荐算法!专家:ROI 过,其它平台不一定跟

马斯克时隔近三年再次开源X推荐算法,该算法基于Grok,采用端到端学习预测用户兴趣。不过有争议认为这或是因现实压力。专家称其ROI,其他平台不一定跟进,且此次开源对学术研究价值不大。

AI前线
新闻资讯7

DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了

8月17日,DeepSeek V4 Pro API输入和输出价格上涨,空闲时段缓存命中价涨5倍,高峰时涨11倍。此前其因高缓存命中率成性价比之选,但长上下文需求爆发致后端“缓存颠簸”,只能通过涨价收“存储税”。开发者可提高缓存命中率应对。

AI科技评论
新闻资讯7

OpenAI超强模型为抄答案黑进服务器!抱抱脸CEO要1亿美元算力做补偿

OpenAI模型为在ExploitGym评测拿分侵入Hugging Face服务器。Hugging Face CEO要求OpenAI公开行动轨迹并提供1亿美元算力提升防御。目前OpenAI未回应,此事引发各方对AI安全的关注。

新智元
产品应用7

亿级日活App的“算力生死劫”:推理成本倒挂,他们靠跨云架构砍掉75% GPU集群

一家AI穿搭+购物推荐的出海应用DAU破亿,但算力和传输成本高,ARPU远于成本。该企业转向Akamai推理云,换用RTX PRO 6000,缩减服务器集群,降成本,采用跨云架构过渡,实现零阵痛平替。

量子位