「INT4量化」共找到 1663 篇相关文章
大语言模型逻辑评估
现有归因问答评估方法有‘归因短视’问题,研究团队提出 LOGICSCORE 框架,从三维度量化推理质量。在多数据集测试多款 LLM,发现专有、开源模型等存在不同逻辑问题,还分析典型逻辑错误。
谷歌Veo 3.1更新:更一致性、更具创造力和控制力
谷歌Veo 3.1发布更新,实现角色、背景与物体在动态场景中的高度一致性,支持基于参考图片创建视频、原生竖屏模式及1080p和4K分辨率升频,精准控制素材,提升创作体验。
2025年末全球 AI 行业流量报告:狂热退潮,分化开始
Similarweb报告显示,2025年Q4 ChatGPT流量同比跌22%。各AI产品走势分化,如Gemini涨49%,Claude坐“过山车”。AI编程、写作等领域也有不同表现,还揭示对传统行业冲击没那么快。
构建知识闭环:用CodeBuddy打造自我进化的数据分析体系
腾讯团队为解决数据分析痛点,构建知识闭环体系,利用CodeBuddy设计开发规范、自动生成SQL,将编码从小时级降至分钟级。体系含沉淀、传递、生成、信赖、闭环五环,提升团队效率与协作。
突破视觉-语言-动作模型的瓶颈:QDepth-VLA让机器人拥有更精准的3D空间感知
视觉 - 语言 - 动作模型(VLA)在机器人操控领域潜力大,但应对长时序或精细操作任务时性能下降,根源是缺乏三维空间感知与推理能力。中国科学院自动化研究所与灵宝 CASBOT 提出 QDepth - VLA 模型,提升了机器人空间推理与操控精度。
30秒,我用蚂蚁灵光复刻了个支付宝(doge)
蚂蚁集团推出全模态通用AI助手灵光,最快30秒生成私人定制小APP,可编辑交互分享。实测其功能丰富且专业,实现多模态输出和多智能体协作。还对比了与千问区别,介绍蚂蚁AGI布局。
内存涨价赛过黄金,这些存储公司业绩、股价两开花
近期存储价格年内持续飙涨,幅度超黄金。DDR4现货价较年初暴涨200%,部分经销商溢价出售。存储产品涨价源于AI应用扩张,供不应求热潮蔓延至封测端。多家存储公司业绩和股价两开花。
别再只关注KV Cache了! LLM稀疏性新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案
团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。
大模型优秀大脑齐聚硬核开源聚会,SGLang社区举办国内首次Meetup
10月25日,SGLang联合美团、亚马逊云科技在北京举办国内首场Meetup。SGLang是开源高性能推理引擎,特性丰富。活动中大咖和开发者分享见解、进展、应用场景,展现其社区活力与发展潜能。
超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破
文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。