激活值内存」共找到 637 篇相关文章

新闻资讯7

AI四小龙,估破万亿

中国AI四小龙估破万亿,DeepSeek、智谱、MiniMax、月之暗面各有不同定价逻辑。它们估暴涨受技术、港股窗口、国家大基金入场等因素影响。当下,它们面临算力和场景问题,未来发展各有挑战。

芯师爷
算法论文8

谷歌的DeepSeek时刻:LLM推理加速被干到了8倍

谷歌TurboQuant论文介绍量化算法,能为大语言模型和向量搜索引擎大规模压缩。可将大语言模型KV缓存内存减至少6倍、加速达8倍且精度零损失,还介绍其工作原理及实验结果。

PaperAgent
新闻资讯7

突发,Fable 5.1泄露了!Claude又叒叕全球大宕机

今日,Fable 5.1被曝开启灰度测试,部分Claude用户已免费试用。推测其可能很快全量推送且不涨价。此前Fable 5因性能强受限,开发者期待5.1版。同日Claude全球大宕机,Anthropic正冲刺万亿估

新智元
推荐文章8

极致优化Android平台APK的大小

文章以Android为例,介绍UE包可裁剪部分的优化思路与实践,优化APK大小和Native库运行时内存占用。从压缩NativeLibs、代码体积优化、资源裁剪等方面着手,还给出优化效果和额外资料。

腾讯技术工程
开源动态8

腾讯混元推出首款开源混合推理模型:擅长Agent工具调用和长文理解

6月27日,腾讯混元开源首个混合推理MoE模型Hunyuan - A13B,参数80B激活仅13B,推理快性价比高。它在多测试集成绩好,尤其擅长Agent工具调用和长文理解,还开源两数据集填补评估空白。

AI前线
新闻资讯8

LiblibAI 母公司完成近 3 亿美元融资:AI 应用层开始进入「收入说话」的阶段

近日,演语科技披露近3亿美元B+轮融资,投后估超20亿美元。其旗下有LiblibAI、LibTV、星流等业务,已构建AI创意内容生产应用矩阵。截至2026年5月,ARR达3亿美元,收入年同比增超3000%。

AI科技评论
新闻资讯8

2025 AI 趋势报告:Agents 正在跨越鸿沟

《2025 AI 趋势报告》指出,AI 智能体跨过鸿沟被广泛采用,能力比肩人类,成本优势显著,影响招聘。能源成制约,生成式 AI 普及快,收购成主要退出路径,虽估高但基本面尚好,还分析了下一波创业切入点。

特工宇宙
开源动态7

LM Studio宣布支持在Mac上跑Qwen3-Next 80B模型

LM Studio宣布支持基于MLX框架在Mac上运行阿里Qwen3-Next 80B模型。该模型虽总参数量达800亿,但每次推理仅激活30亿。第三方评测显示其4bit量化运行效果好,不过实现GGUF格式支持尚需时间。

AI工程化
推荐文章8

拆解 Anthropic:最好的 AI 公司,可能也都是一种组织发明

过去一年,Anthropic 是 AI 行业最得研究的公司,创造了最快爆发性增长,估反超 OpenAI。文章从战略判断和组织文化两方面拆解其成功原因,分析与 OpenAI 的差异,还指出 AI 竞争中组织文化的重要性。

海外独角兽
新闻资讯7

半导体股大涨!千亿市芯片企业全景图一览

本文结合2026年5月6日收盘数据,盘点国内A股和港股市破千亿的半导体企业格局,剖析产业推手,探讨隐忧与走向。AI算力芯片、晶圆代工、设备、存储芯片企业表现亮眼,市飙升有产业逻辑,但部分企业估存风险。

芯师爷