计算成本」共找到 2066 篇相关文章

新闻资讯7

AI Infra 工程师们如何应对大模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播邀请华为、蚂蚁集团等专家探讨大模型 Infra 工程师实战日常。涉及大模型工程高频问题、版本迭代冲突处理、推理部署成本优化、开源项目挑战及 GPU 虚拟化趋势等内容。

AI前线
推荐文章8

揭秘千卡 GPU 集群如何高效训练多模态大模型:vivo AI 团队实战经验分享|AICon

在 InfoQ 举办的 AICon 大会上,vivo AI 架构师王兆雄分享多模态大模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。

AI前线
产品应用7

从扭秧歌到跑半马:机器人离「iPhone时刻」还有多远?

过去半年,机器人表演把人们认知拉进现实。当下具身智能赛道玩家关注缩短探索周期、降低成本。地瓜机器人发布 RDK S100 套件,其有独特设计和适配场景,还围绕开发者诉求提供支持,跑通多种场景。

机器之心
新闻资讯7

一文读懂:国产AI芯片与英伟达的差距有多大?

文章围绕国产AI芯片与英伟达的差距展开。从算力性能、生态壁垒、市场现状、技术瓶颈等方面分析差距,指出国产芯片虽在部分场景缩小差距,但高端训练和生态成熟度仍落后3 - 5年,突围需多领域突破。

芯师爷
开源动态7

250美元起售,还开源,Hugging Face 发布史上最亲民人形机器人

Hugging Face 开源两款人形机器人 HopeJR 和 Reachy Mini,前者全尺寸有 66 个驱动自由度,售价约 3000 美元;后者成本低至 250 美元,可用于测试 AI 应用。虽被指外观不佳,但推动开源机器人生态发展。

机器之心
推荐文章7

大概念模型:AI 推理的新范式

大概念模型(LCM)是自然语言处理新范式,侧重结构化推理和理解,与 LLM 不同。它依赖结构化知识,可模拟专家思维,解决当前 AI 缺陷,文章还介绍其架构、应用、局限,探讨与 LLM 结合的未来发展。

InfoQ
新闻资讯7

OpenAI自曝:AI推理砸钱越多,碾压人类越狠!

OpenAI研究员探讨推理模型时代。Noam Brown强调预训练和推理范式,指出当前AI胜在通用性。推理范式成本低、效果好,如o系列模型表现出色。首席经济学家谈AI经济影响,称其重塑企业格局。

新智元
开源动态7

全球闲置算力训个模型,性能媲美R1,老黄天塌了!Karpathy曾投资它

全球首个分布式RL训练模型INTELLECT - 2发布,整合闲置算力完成训练,成本降低,性能媲美DeepSeek - R1。其采用分布式异步强化学习范式,团队开源四大关键组件,还获Karpathy等投资,未来有多项计划。

量子位
开源动态8

字节Seed新方法!开源8B代码模型:自己筛数据训练自己,同量级SoTA,还能超越百亿级对手

传统code大模型依赖人工筛选数据,成本高、效率低。而Seed - Coder团队让LLM自己筛选数据训练自己,打造8B参数轻量级开源代码模型,性能超百亿级对手,不过也存在通用和数学能力短板。

深度学习自然语言处理
产品应用9

让企业拥有自己的模型!PyTRIO定义TaaS新范式:大模型训练进入API时代

本文围绕企业自主训练专属大模型的行业趋势展开,指出当前大模型训练门槛高、工程成本大的痛点,介绍情感机器推出的PyTRIO训练平台,提出TaaS新范式,封装底层工程,开放训练API,降低训练门槛。

机器之心