「长时稳定性」共找到 1304 篇相关文章
DeepSeek 为什么把缓存涨了 11 倍?长上下文需求暴涨,得交点「存储税」了
8月17日,DeepSeek V4 Pro API输入和输出价格上涨,空闲时段缓存命中价涨5倍,高峰时涨11倍。此前其因高缓存命中率成性价比之选,但长上下文需求爆发致后端“缓存颠簸”,只能通过涨价收“存储税”。开发者可提高缓存命中率应对。
存储的超级周期,缺货潮将贯穿2026年?
近期存储市场火热,价格飞涨,下游厂商面临成本压力。缺货潮或贯穿2026年,因AI需求爆发,三大厂商减产DDR4等产能。其他厂商难补缺口,华邦虽有扩产计划但周期长。端侧AI发展对存储有新要求,华邦布局相关产品。
苹果不吹 AI,反而成功了?
北京时间9月10日苹果发布会,新款iPhone等产品更新。此次发布会多数环节AI几乎消失,与iPhone 16发布时大肆宣传不同。苹果因在智能体AI助手进展落后,重点放硬件及AI幕后支持。不过苹果仍承受分析师压力,且在AI竞赛中落后。
投入AI越多,跌得越猛!美股巨头只有AI拉胯的苹果在猛涨
本周财报季,亚马逊、谷歌和微软等科技巨头虽营收光鲜,但股价集体跳水,市值合计蒸发9000亿美元。因2026年计划砸6600亿美元建AI基建,市场担心回报周期长。而苹果未参与军备竞赛,与谷歌合作,营收创新高、支出降低、股价上涨。
大模型思维链推理速度倍增!——RoT新框架把思维链「画」进隐空间
随着大模型规模扩展,思维链(CoT)成处理复杂推理任务标准范式,但显式CoT依赖长序列生成,隐式CoT面临优化挑战。腾讯提出RoT新框架,利用视觉编码器将文本推理步骤转为视觉嵌入,实现Token压缩与推理加速,且过程可分析。
RL在Agentic Reasoning中的作用:拨开迷雾,看清本质
近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。
AI x 保险图谱:第一家 AI-Native 的保险独角兽会长什么样?
保险业规模庞大但运营效率极低,超 60%流程依赖人工,索赔周期长、客户满意度低。过去两年,LLMs 提升了 AI 处理非结构化信息的能力,使 AI 接管保险核心流程成为可能。GenAI startup 围绕保险流程构建产品,AI-native 保险公司也应运而生。
陶哲轩长文剖析现代社会:大型组织挤压小型社群,个体陷入疏离困境,AI正在加速这一进程
陶哲轩长文以协作式数学项目社群现象为切入点,提出观察现代社会的框架。指出现代技术和激励体系在赋能个体与大型组织时,严重削弱小型组织,导致个体精神上出现脱节感,AI还在加剧这一问题,并给出新兴草根组织视角。
谈一谈TP推理场景下MoE Group GEMM的优化思路
作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。
南大团队直击大模型高分神话:人类90分,最强模型仅49分
南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。