训练加速」共找到 2662 篇相关文章

推荐文章7

TPU vs GPU 全面技术对比:谁拥有 AI 算力最优解?

SemiAnalysis对Google TPU v7/v8深度拆解,将TPU与Nvidia GPU多方面对比拆到可计算层面。不过其结论有局限性,本文重新分析,指出TCO因场景而异,互联体系分歧在流量假设,Google TPU v8成本优势被削弱。

海外独角兽
新闻资讯8

Nature重磅:智能的尽头是算力!谷歌大佬承认「预测下一个词即智能」

芯片速度触顶,摩尔定律失效,但AI却在疯狂跃迁。Nature文章指出,智能的增长不靠芯片加速,而是结构重组与协作。其核心是预测和并行协作,AI正以类似生命演化的方式发展,与人类相互依存。

新智元
开源动态8

华为新开源!扩散语言模型突破32K上下文,还解锁了「慢思考」

今年文本生成领域从自回归向扩散语言模型转变,但长序列训练不稳定是痛点。华为发布 openPangu-R-7B-Diffusion,将上下文长度扩至 32K,在多基准创 7B 参数量级 SOTA,还解析了其技术革新。

机器之心
新闻资讯7

万卡时代,企业需要怎样的算力集群?

过去两年,AI算力需求跃升,消耗从训练主导转向推理驱动。企业算力需求有突发性等特点,智算集群是关键方案。InfoQ联合腾讯云发起直播探讨,还介绍了算力供给缺口、集群构建交付、性能优化及演进方向。

InfoQ
新闻资讯7

从 Apple M5 到 DGX Spark ,Local AI 时代的到来还有多久?

近期,黄仁勋将桌面级AI超算DGX Spark交付给马斯克引发热议。同时,Apple Silicon等芯片下放端侧推理能力,本地运行时和端侧模型供给加速成熟。但本地算力等问题仍制约消费终端Local AI大众化落地。

机器之心
新闻资讯7

14万一台家务机器人!斯坦福华人博士具身创业首款产品亮相,用户还能买回去自己教

斯坦福华人博士赵子豪与迟宬创业推出家务机器人Memo,售价2万美元。它能完成多项家务,依赖ACT - 1具身模型,该模型用技能捕捉手套采集人类数据训练,用户还能教它新本领,预计2026年正式推出。

量子位
算法论文8

上海AI Lab提出CANON:让RLVR自主识别优质推理模式

上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。

深度学习自然语言处理
产品应用7

终于有人解决机器人洗手洗澡问题了

杭州云深处发布全新人形机器人DR02,全球首款具备IP66防护等级,可防尘防水,能在复杂户外环境稳定运行。云深处从四足迈向两足,借户外作业经验走出差异化路线,加速人形机器人商业化。

量子位
推荐文章7

Andrej Karpathy深度解读:强化学习之父为何说大模型违背了「苦涩教训」

Andrej Karpathy深度解读Sutton与Dwarkesh的播客对话。Sutton认为大模型不符合「苦涩教训」,因其训练依赖人类数据集。他追求类似动物通过强化学习与世界交互的系统。Karpathy认可批评,认为找到符合原则算法是突破。

AGI Hunt
算法论文8

从少样本到千样本!MachineLearningLM给大模型上下文学习装上「机器学习引擎」

新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力大,还指明未来研究方向。

机器之心