检索脆弱性」共找到 769 篇相关文章

开源动态7

Vercel 开源 Bash 工具:基于本地文件系统的上下文检索

Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。

InfoQ
开源动态8

蚂蚁C2LLM:基于注意力池化的代码检索新范式

在Code RAG场景中,传统文本Embedding模型处理代码表现欠佳。蚂蚁集团与上海交通大学联合发布C2LLM系列模型,引入注意池化模块,在MTEB - Code榜单表现出色,还得益于优质训练流程,成果已回馈社区。

PaperAgent
新闻资讯7

DDR4持续涨价,DDR5成为新的比价之王?

近期DDR4价格持续上涨,其告别价比,原因是存储巨头战略转移。而DDR5能强、功耗低,实测表现优,价格也有优势,已成为新的“价比之王”,替代DDR4是大势所趋。

芯师爷
算法论文8

RL救不了泛化!揭示LLM数学Reasoning的深层瓶颈

大型语言模型在数学竞赛级任务依赖机械化推理,现有评测集有缺陷。UC Berkeley团队提出OMEGA基准量化其数学泛化能力,实验揭示复杂度引发能崩塌等问题,指出LLM创新组合难,给出改进方向。

深度学习自然语言处理
产品应用7

Jina 第4版:多模态向量检索,统一适配,挑战3大任务

Jina第4版基于Qwen2.5 - VL模型扩展,支持单向量和多向量输出。它经对比学习和任务特化训练,推理时可按需选LoRA适配器,能利用多模态处理能力优化不同任务能。

CourseAI
开源动态8

谷歌推出 LLM-Evalkit,为提示词工程带来秩序与可衡量

谷歌推出基于 Vertex AI SDK 的开源框架 LLM - Evalkit,让大语言模型提示词工程更有序可衡量。它整合实验、测试等环节,与谷歌云工作流集成,有无代码界面,已在 GitHub 发布。

AI前线
新闻资讯7

探访爱机器人公司Somnia Lab:卧室里的与AI|甲子光年

本文探访了爱机器人公司Somnia Lab,其创始人Xara坦诚表示在研发能和人类亲密互动的机器人。公司已完成三轮融资,产品‘硅姬’将入市,‘硅君’预计2027年面世,公司规划独特,技术有突破,试图变革行业。

甲子光年
算法论文8

最具争议研究:大模型中间层输出可 100% 反推原始输入

意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。

AI科技评论
算法论文7

管你模型多大,250份有毒文档统统放倒,Anthropic:LLM比想象中脆弱

Anthropic等联合研究打破传统观念,只需250份恶意文档就能在参数规模从6亿到130亿的LLM中植入后门,且与模型规模及训练数据量无关。研究还测试了特定后门攻击,评估了多种训练配置。

机器之心
新闻资讯7

谷歌Gemini一次提示能耗≈看9秒电视,专家:别太信,有误导

谷歌报告称处理一个中位数的Gemini文本提示能耗低,2024 - 2025年单个文本提示能耗降33倍、碳足迹减44倍,归功于全栈式优化。但专家质疑其方法论,指出未算间接用水、碳排放核算不全等问题。

机器之心