「激活值内存」共找到 633 篇相关文章
成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力
信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。
当黄仁勋将存储定义为「AI运行内存」,基础设施该如何实现物种进化?
AI算力需求使全球内存市场疯狂,黄仁勋称存储技术需重构。XSKY星辰天合发布AIMesh方案,战略转向数据智能,其方案可破传统存储架构三堵墙,还坚持中立,助力企业数据转化。
向英伟达发起挑战的 AI 芯片初创公司,估值快五百亿了!
人工智能芯片初创企业 Groq 完成 7.5 亿美元融资,投后估值 69 亿美元。它试图打破英伟达垄断,产品是专用芯片,面向开发者与企业,成本低于竞品,创始人技术背景深厚,服务开发者数量增长快。
老年代的“滞留对象”:一次由提前晋升引发的线上内存告警排查
文章以线上环境内存告警排查为例,介绍过程和思路。发现老年代因大量不可达对象占用且未触发FullGC致告警,排查出对象提前晋升是主因,还给出调整参数、减少对象产生等解决办法。
24K+ star!AI 专用无头浏览器,快11倍、内存省9倍!
Lightpanda是专为AI代理、网页抓取和自动化测试而生的开源无头浏览器,用Zig语言重写核心引擎。官方称其速度比Chrome快11倍,内存占用仅为1/9,兼容主流自动化库,目前处于Beta阶段,已获24k+ Star。
英伟达MIT出手!华人团队重磅开源,大模型推理内存暴降10倍
英伟达、MIT、浙大华人研究者联合推出TriAttention,核心是在pre - RoPE空间用Q/K三角集中度估计KV token重要性,保留关键部分。它使内存消耗降10倍,吞吐量提2.5倍,还提供vLLM集成和MLX实验性支持。
美光三星海力士遭集体诉讼!郭明錤:27年都买不到便宜内存
17名美国消费者和小企业主起诉三星、SK海力士和美光,指控其合谋减产、抬高内存价格。二十年前它们就有类似前科。郭明錤预计‘内存荒’至少持续到2027年,这让诉讼意义复杂。
单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025
基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。
6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗大模型发布
由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。
田渊栋AI创业估值315亿,老黄苏妈都投了,姚班施天麟也是合伙人
离职Meta的田渊栋成AI创业合伙人。Recursive Superintelligence获6.5亿美元融资,估值46.5亿美元。谷歌GV等领投,英伟达等参与。8位联创阵容豪华,要做AI自我改进,押注递归式自我改进。