大算力芯片」共找到 5988 篇相关文章

推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十】| “过拟合” 与 Dropout

文章围绕神经网络过拟合问题展开,介绍了过拟合的概念、危害及产生原因,阐述了缓解过拟合的正则化方法,重点介绍了Dropout随机失活,还指出其局限性及在模型中的应用策略。

AI大模型应用实践
新闻资讯7

豆包要收费了:三档订阅最贵500元/月,保留免费基础版

五一假期时,豆包要收费的消息冲上热搜。苹果App Store已现订阅服务声明,分三档,最贵500元/月,目前仅测试,正式上线会发完整信息,且保留免费版。豆包APP日活、用户新增和规模都断层领先。

量子位
产品应用7

求稳的安全IP,安谋科技如何守正出奇?|甲子光年

12月24日,安谋科技推出新一代SPU IP——“山海” S30FP/S30P,构建覆盖芯片底层至应用层的一栈式安全防护体系,有抗物理攻击强等五亮点,能适配不同场景安全需求,完善产品布局。

甲子光年
技术分析类文章7

Pingpong Schedule并不是万能钥匙

SGLang社区开发者反馈,SM90 FP8 Blockwise Scaling Grouped GEMM从H20迁移至H800后性能下降。文章分析是Pingpong调度策略所致,因算力提升,其使TensorCore未充分利用、TMA效率低,建议用Cooperative策略。

GiantPandaLLM
新闻资讯8

Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键

Anthropic 两位研究员在采访中表示 2025 年强化学习在语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。

Founder Park
推荐文章8

第一章:AI 技术前沿全景

文章聚焦AI Agent技术前沿,阐述语言模型三次能力跃迁,从涌现能力到对齐指令遵循,再到推理与行动。还提及Scaling Law变化,推理时计算扩展更划算,介绍代表性推理方案及多模态融合,指出Agent打破传统对话AI局限。

CourseAI
新闻资讯7

硅谷GPU蒙尘,马斯克一言成谶:美国AI被电卡脖子

彭博社消息,加州圣克拉拉两处数据中心空置6年多等电力,凸显美国科技行业缺电问题。此前微软纳德拉承认缺电致GPU吃灰,马斯克也曾预言芯片或超供电能力。电力短缺制约数据中心发展,影响美国AI前进。

新智元
推荐文章7

一文看懂“提示词” vs “提示词工程” vs “上下文工程”

文章区分了提示词、提示词工程和上下文工程的概念。提示词是给AI模型的输入文本;提示词工程是设计、测试、优化提示词的过程;上下文工程是为模型构建动态上下文的学科,在AI Agent背景下诞生。

宝玉AI
新闻资讯7

AI搜索平台Glean获1.5亿美元,估值72亿美元

CNBC消息,AI搜索平台Glean完成1.5亿美元F轮融资,估值升至72亿美元。其核心产品是企业级搜索平台,可集成多应用。资金将用于团队扩张和拓展市场,但也面临激烈竞争,技术可与模型互补。

AIGC开放社区
推荐文章8

搜索SEO被AI重塑,专业内容社区价值凸显 | 量子位智库报告

量子位智库报告指出,模型颠覆传统搜索,传统SEO正被重构。实验显示近半AI回答引源自内容社区,专业话题中占比更高,知乎被引频率最高。报告认为SEO应向SPO转变,专业内容社区价值凸显。

量子位