「龙虾量化」共找到 383 篇相关文章
对话港大黄超、任旭滨:龙虾热潮、nanobot、CLI与AI开源方法论|甲子光年
本文是甲子光年对港大黄超、任旭滨的访谈实录。二人介绍多个开源项目,如nanobot、ClawWork、CLI - Anything等,探讨OpenClaw热潮,认为焦虑与机会并存,还分享团队开源理念与研究方向选择方法。
2026国内 OpenClaw 完整指南!12个平台一站式汇总,零代码养龙虾再也不是梦!!
腾讯举办OpenClaw小龙虾免费安装活动,让更多人意识到其时代已至。国内各大厂和云平台推出一站式封装平台,解决安装难题。文章汇总扣子Coze、腾讯QClaw等12个平台,介绍特点、适合人群等。
97年金融男带8只「电商龙虾」全球开店!2个月后同行慌了
阿里版「电商龙虾」Accio Work打通国际站,一个工作台可全包选品、发品等七个岗位的活。它结合多维度数据助力选品,还能进行广告诊断、店铺运营等,在不同商家案例中成效显著。
2.2K 标星的龙虾办公可视化项目!OpenClaw 专属的像素风「赛博办公室」!
由`海幸Hyacinth`和`Simon_阿文`联手打造的Star-Office-UI(龙虾办公室)在GitHub开源,获2.2K标星。它把AI助手工作状态变成像素风看板,打破人机交互冰冷感,还具多亮点及API,上手简单。
LightX2V fp4 quant kernel代码笔记
这是关于 LightX2V 里 `lightx2v_kernel` 做 FP4 量化 GEMM 的读码笔记,解释接口和约束、kernel 关键路径等问题,还介绍 NVFP4 和 MX-Formats 量化原理、代码实现,以及 LightX2V 项目中的实际使用。
AI 本地跑?Google 新开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言
Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。
【博客转载】CUDA Vectorized Memory Access (文末送书)
文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小及方法的性能,得出拷贝数据单元多、单元大及以8或16字节向量化单元拷贝可提升带宽等结论。
龙虾纪元
2026年春天,OpenClaw这一开源项目爆火,星标数逼近25万,国内云厂商纷纷接入。它虽技术上无优势,但产品形态出色,把AI变成“住在手机里的助理”,不过也存在安全等问题。
DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜
DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。
挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026
IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三大挑战。