「长上下文困境」共找到 1349 篇相关文章
Claude被美封杀后,Anthropic CEO回应一切!
2025年7月Anthropic与五角大楼签2亿美元合作合同,因提出AI不得用于全自主武器及大规模国内监控遭拒。美国防部长称其技术有“国家安全供应链风险”,Anthropic CEO回应坚持红线是捍卫美国价值观。
不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化
随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。
阿里巴巴新论文:让LLM学会管理记忆,告别人工规则
大型语言模型处理长对话或复杂任务时,记忆管理靠人工规则,效果有限。阿里巴巴团队新论文提出把记忆管理变为可学习的强化学习策略,AgeMem框架统一长短期记忆管理,经三阶段训练,效果显著。
港大开源视频版RAG,像聊天一样看完百小时纪录片。
港大HKUDS团队开源超长视频理解框架VideoRAG,突破传统模型时长限制,支持对数百小时视频精准检索和问答。还有桌面应用Vimo,使用简单高效。介绍了其切片索引、混合检索、生成回答的实现逻辑。
Deepseek是被降智了吗?
作者认为Deepseek被降智,存在诸多问题,如不懂用户意图、长文理解差、措辞怪异、提示词调教难、无脑捧杀、幻觉率高、深度思考弱等,还对比了与GPT在人际交往话题回复上的差异。
告别「盲目自信」,CCD:扩散语言模型推理新SOTA
华为小艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。
重磅发布!国家队出手解决企业跨省通信「老大难」,语音识别错误率暴降20%
企业全国语音通信业务曾面临交付周期长、AI应用门槛高的问题。联通云犀平台以「全云化架构+语音AI基座」破局,实现架构重构与AI进化,降低方言识别错误率,在多行业落地降本增效。
LightMem用3招重新设计了LLM的记忆,结果出乎意料
LLM在超长多轮对话中有上下文窗口有限、记忆系统昂贵的痛点。LightMem借鉴人类记忆机制,用三招重新设计LLM记忆,实验显示其准确率超基线,还降低token使用量、API调用和运行时间。
智驾新玩家首秀,“含模量”将成为新标准|甲子光年
9月28日千里科技召开首次品牌发布会,董事长印奇展示智能辅助驾驶系统能力。其角色从定点车企服务商变为全车企伙伴,首创‘含模量’概念,还公布‘千里计划’,欲构建跨场景智能服务体系。
他在 10 天内拼出 ChatGPT,如今影响 7 亿人:ChatGPT 负责人的第一次讲述
OpenAI产品负责人Nick Turley首次分享ChatGPT幕后故事。ChatGPT从黑客马拉松项目起步,10天内发布,如今周活超7亿。他还介绍了GPT - 5特性,以及ChatGPT长期愿景、发展迭代、团队组建等情况。