量化技术」共找到 2962 篇相关文章

新闻资讯7

裁4000人换来的AI全白搞?Salesforce悄悄改架构:用 “老技术”故障少还省钱,网友怒喊:CEO零遣散费滚蛋

Salesforce曾大举部署AI并裁员,宣称Agentforce能降本。但如今高管称不过度依赖大模型时运行更好,已引入基础自动化技术。其应用遇瓶颈,故障频发、成本高,还面临AI“漂移”等问题。

AI前线
推荐文章7

“你的Agent,我一周末就能做出来!” AI时代的护城河:Cursor 卷每日迭代速度,DeepSeek 用技术撕大厂规模优势

文章围绕AI时代创业的“护城河”展开,介绍YC播客讨论内容,指出因ChatGPT易复制,创业者需思考持久商业模式。还列举Cursor、DeepSeek等案例,阐述速度、流程之力等多种构建护城河的方式。

InfoQ
产品应用8

华为曝光两大黑科技!打破推理延迟魔咒,大模型从此「秒回」

华为通过FusionSpec和OptiQuant两大技术创新,对MoE模型进行推理优化。FusionSpec依托昇腾特点,将投机推理框架耗时降至1ms;OptiQuant支持灵活量化,为大模型推理提供高性价比。

新智元
算法论文8

Discrete Tokenization:多模态大模型的关键基石,首个系统化综述发布

近年来,人们关注将LLM能力扩展至非文本模态,Discrete Tokenization成关键方案。但现有研究缺系统总结,香港科技大学等团队发布首个相关系统化综述,梳理技术脉络、方法及挑战,给出未来研究方向。

机器之心
新闻资讯7

DSpark推理速度提升80%后,OpenAI宣布新方法将推理成本降低了一半

近日,OpenAI 工程师开发优化技术,将模型推理成本降一半。业内猜测或基于公开成果,也有人认为是模型量化。此前 DeepSeek 推出 DSpark,使 V4 模型推理速度提升 60%-85%,还引入峰谷定价机制。

AI科技评论
算法论文7

低延迟、高吞吐,LLM优化与高效推理引擎综述

LLM计算成本高,用户要低延迟,企业要高吞吐。工程师开发优化技术,如动态批处理、KV缓存、模型量化。论文对比25款推理引擎,还探讨了多模态支持、手机端推理、新型架构支持等进化方向。

深度学习自然语言处理
产品应用7

我把Claude变成了带记忆的人生教练,结果它比我还了解我自己|人生教练 Agent v2.1

作者将Claude打造成带记忆的人生教练,记忆功能让教练能回顾过往对话。其技术栈不复杂,相比传统教练优势明显。虽有缺乏情感共鸣等局限,但能发现认知盲区,未来有改进空间。

AI 产品自由
7

多家芯片公司业绩飙涨,这个赛道彻底火了?

近期多家A股芯片公司Q3财报亮眼,受益于端侧AI推进。端侧AI优势多,吸引科技巨头布局,但落地有挑战。技术进步使大模型轻量化,手机与AI眼镜较热。其发展面临应用、技术、生态等问题,也有隐私保护方案。

芯师爷
开源动态8

小扎万字檄文炮轰硅谷,Meta重磅开源30B小钢炮!一台MacBook就能跑

Meta发布全新30B大模型Muse Glimmer并开源,用4-bit量化技术让其能在本地设备运行,有五大核心超能力且采用Apache 2.0协议。同时,Meta CEO小扎发表万字檄文暗讽OpenAI等,抨击AI末日论等观点。

新智元
推荐文章8

为什么说多模态是推荐系统破局的关键?来自饿了么一线的实战复盘

文章围绕多模态推荐展开,从传统推荐算法演进到多模态表征技术,结合饿了么场景实践,还探索生成式推荐。介绍多模态推荐挑战与代表性工作,梳理表征技术发展,详述饿了么系统设计与训练,分析生成式推荐方案及业界路线。

阿里云开发者