「检索脆弱性」共找到 769 篇相关文章
探索 GPU 加速向量检索:NVDIA Cagra 在微信大规模推荐系统中的应用实践
本文分享腾讯团队将 Cagra GPU 图索引大规模应用于微信核心线上推荐业务的实践。介绍 Cagra 算法原理与优势,讲述线上化改造、架构演进、CPU/GPU 协同优化等,展示业务落地显著收益。
2025科技圈最新职位:“Vibe Coding擦屁股工程师”,专治老板们的决策性Bug
生成式AI兴起后,科技公司CEO用其取代员工致大量裁员。但“氛围编程”效果不佳,AI生成代码常需修复,“氛围编程清理专家”应运而生,市场需求或不断增长,不过网友对此看法不一。
华为开源突破性技术Flex:ai,AI算力效率直升30%,GPU、NPU一起用
11月21日,华为发布AI容器技术Flex:ai并联合高校将其开源。该技术基于Kubernetes构建,有三大核心突破,能提升算力利用率,异构兼容性优于Run:ai,将推动国产算力应用。
别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析
agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。
代码检索新王登基!CodeFuse | 开源C2LLM,用“注意力池化”刷新MTEB-Code榜单
蚂蚁集团与上海交通大学推出C2LLM系列模型,基于注意力创新池化机制解决代码表征痛点,登顶MTEB - Code榜单。作为CodeFuse Embedding开源家族成员,将全套回馈社区,为代码大模型研发提供基线。
ACL'25最佳论文解读 | 大模型也会‘弹簧回弹’?揭秘 LLM 对齐的脆弱根源
本文分享 ACL 2025 最佳论文,指出预训练大模型存在‘抗对齐’的 Elasticity 现象,即对齐微调只是暂时拉伸,后续微调会让其迅速弹回预训练分布。研究量化该概念,用‘压缩理论’刻画对齐并实验验证。
泛化性暴涨47%!首个意图检测奖励范式,AI工具爆炸时代意图识别新解法
随着大模型和工具增长,AI 助手意图识别遇新挑战。腾讯 PCG 团队用强化学习等方法,提升模型泛化能力,还从多方面剖析优势,最后提出未来研究方向。
最烦做演讲!黄仁勋曝英伟达养了61个CEO、从不炒犯错员工:CEO是最脆弱群体
在一场访谈中,英伟达CEO黄仁勋称英伟达有61位“CEO”,犯错员工不会被解雇。他表示自己是“不情愿的CEO”,不喜欢演讲。还断言AI将改变计算机运作模式,未来工作岗位会变但不减少,没工作的人或因此谋生。
刚刚,OpenAI公司结构重大调整:继续由非营利实体控制,营利性部门要变公益公司
OpenAI官方宣布公司结构重大调整,将继续由非营利组织控制,现有营利部门成公益公司(PBC),非营利组织控制PBC并成大股东,二者使命相同。这是与相关部门对话后决定。
别再只关注KV Cache了! LLM稀疏性新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案
团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。