「低token高压缩」共找到 1724 篇相关文章
你的「龙虾」真记得你吗?剑桥发布长期个性化记忆基准ATM-Bench
剑桥大学团队开源面向AI个人助理的长期记忆基准测试ATM - Bench,评估AI面对真实生活数据时能否「记住你」。实验结果不佳,专用和通用智能体系统准确率低,凸显长期个性化记忆问答难题。
The Batch: 939 |在推理阶段学习长上下文
大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。
面壁智能开源 EdgeClaw,一款安全高效端云协同的龙虾 Agent。
当下AI Agent端侧常被忽视,数据任务都涌向云端致隐私泄露和算力浪费。近期面壁智能等联合开源EdgeClaw,以三级安全和性价比感知协同机制,解决OpenClaw数据泄露、token成本高等问题。
黄仁勋:龙虾就是新操作系统!英伟达7种芯片拼出算力怪兽,放话2027营收万亿美元
英伟达GTC 2026上,黄仁勋回顾发展历程后预计2027年营收至少达1万亿美元。介绍Token工厂经济学,推出Vera Rubin系统,还谈及OpenClaw,断言企业IT逻辑将改写,也预告了Feynman架构和太空数据中心。
AI时代,为什么我极力推荐你开始写日记?
本文指出在AI时代,日记是个人存在于世界的真实锚定。马伯庸、罗振宇都重视记录,作者介绍低门槛日记方案,强调日记要真实,还可让AI做回顾,呼吁大家从现在开始记日记。
视觉强≠能干活!清北普林斯顿等开源WorldArena,世界模型评测被颠覆
2026 年 2 月 13 日,清华、北大等顶尖机构联合推出的 WorldArena 面向全球开源。这是首个‘功能 + 视觉’统一评测体系,撕开了‘美丽视频’伪装,让评测从‘审美导向’走向‘功能导向’。
MiniMax M2.5:230B参数仅激活10B,开源模型首次逼近Claude Sonnet,成本仅十分之一
MiniMax推出新一代开源模型M2.5,官方称其为‘为现实世界生产力设计的开源前沿模型’。性能逼近Claude Opus 4.6,采用混合专家架构,成本低。已在内部大规模部署,定位为‘AI员工’。
五源投资人笔记:Agent 是新生命,它今天很饿|5Y View
五源投资人石允丰认为,Agent是新生命,以OpenClaw为例,它持续运行,有心跳、记忆等特征且消耗大量token。这引发AI市场“双链分裂”,代谢链潜力大,还带来可靠性、编排等投资机会。
老黄大出血!OpenAI背刺英伟达,微软自研芯连夜拆掉CUDA护城河?
2026年1月26日微软官宣第二代自研AI芯片Maia 200上线,还推出软件Triton。它塞满SRAM,推理成本更低、效率更高。这让英伟达面临生存危机,AI算力圈也变天,降本成关键。
当世界在谈论AI替代人类时,松鼠Ai在达沃斯带回了什么答案?
2026年达沃斯论坛上,松鼠Ai创始人栗浩洋展示教育普惠新路径,其智适应学习系统成本低且效果好。该系统经科学与规模验证,还引发经济核算思考,其全球化发展受国际资本关注。