「Token压缩技术」共找到 3511 篇相关文章
技术奇点与产业拐点:五位顶级投资人的共识与分歧|甲子光年
8月21日「2025甲子引力X中国科技产业投资大会」上,五位顶级科技投资人探讨科技投资。有人从数据看到拐点,如中国Biotech公司License out金额超美;有人从细微处找真相,如科技企业盈利。大家还交流了创新定义、AI引爆点等。
2025 WAIC落幕,深谋科技异军突起,以技术与落地破局具身智能赛道
2025 WAIC落幕,深谋科技作为精英合作伙伴首次亮相,未随波逐流,而是切入脑控、动态视觉伺服和康养场景三大底层能力领域,开拓创新赛道。其产品已商用部署,吸引众多媒体关注。
小扎“超级智能”小组第一位大佬!谷歌DeepMind首席研究员,“压缩即智能”核心人物
最新爆料,谷歌DeepMind首席研究员Jack Rae确认转投Meta,另有消息称Meta还招募了Sesame AI的ML主管。此前小扎还想斥资150亿美元收购Scale AI。小扎为组AGI团队不遗余力,推进速度快。
深度剖析将 Kafka 构建在 S3 上的技术挑战与最佳实践
文章基于AutoMQ深入剖析将Kafka构建在S3上的挑战与解法。探讨延迟、IOPS、缓存管理等问题,介绍AutoMQ应对策略,如用WAL+S3架构降低延迟、批处理数据减少请求等,还提及Kafka兼容性及跨区流量成本处理。
阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理
文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。
Palo Alto5亿美元收购的Portect AI都有什么产品和技术?
2025年4月25日,Palo Alto Networks超5亿美元收购Protect AI,为客户提供端到端人工智能安全保障。Protect AI有两个开源软件ModalScan、LLM Guard和三个平台产品Gardian、Recon、Layer,防护方案完整。
Token烧不起了?比肩Claude Opus 4.6免费模型来了,还将开源
昆仑万维旗下天工AI发布SkyClaw - v1.0,为Agent场景深度优化,免费试用后将开源,价格低。性能超同级别开源对手,逼近闭源巨头。训练围绕环境构建、数据合成、强化学习展开,适合长链路Agent工作流。
ICML 2026 | 拒绝盲目猜token,阿里x浙大将投机解码带入弹性预算时代
随着大模型参数规模扩大,推理成本成核心瓶颈。投机解码在高并发下有问题,阿里与浙大学者提出 ECHO,将投机树构造建模为预算调度问题,通过稀疏门控和弹性预算调度提升系统收益。
超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26
大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。
OpenClaw 技术闭门:测试将比代码更值钱,Agent Computer 会是新的硬件形态
OpenClaw 持续发酵,从极客「玩具」变为生产力工具。闭门分享中,开发者们探讨了其在实际业务中的应用。如代码成负债,测试更重要;不同用户对 OpenClaw 认知差异大;Platform Engineering 成工程师核心,还提及 Agent Computer 新硬件形态等。