检索上下文劫持」共找到 884 篇相关文章

新闻资讯8

刚刚,GPT-5.4 发布,百万上下文、最强全能模型

OpenAI发布GPT - 5.4,集推理、编程等能力于一体,支持百万级上下文窗口。有三个版本,功能全面升级,如支持中途打断、电脑操作、视觉能力提升等,还更省token、少幻觉,安全机制完善,价格有调整。

AGI Hunt
新闻资讯8

刚刚,OpenAI开放GPT-4.1,100万上下文、代码能力超强

今天凌晨1点30,OpenAI宣布开放GPT - 4.1,可在ChatGPT中使用。它针对编码任务,支持100万tokens上下文,在多项测试中表现优于前代,价格更优,不同用户将陆续获得使用权限。

AIGC开放社区
开源动态8

刚刚,字节开源Seed-OSS-36B模型,512k上下文

深夜,字节跳动Seed团队开源Seed-OSS系列模型,含三个版本。其用12万亿tokens训练,在多基准测试表现出色。有灵活推理预算控制等特性,原生支持512K上下文窗口,基准测试成绩佳。

机器之心
算法论文7

ICLR 2025新成果:文档检索“降本增效”,从此“开挂”

传统文档检索系统处理视觉信息丰富的文档存在瓶颈,ColPali方法直接从文档页面图像生成多向量嵌入,简化流程、提高性能、降低延迟。ColQwen - Omni在其架构上扩展到图文+音频多模态匹配。

CourseAI
算法论文7

谷歌:Embedding检索存在根本理论局限,Sparse、Graph才是未来?

近年来稠密向量检索广泛应用,社区认为embedding能‘包打一切’,但谷歌DeepMind从理论与实验指出其存在根本局限。相关实验代码和数据已开源,还给出替代方案。

PaperAgent
算法论文8

GAG:超越RAG,无需检索的私有知识注入新范式

在高价值私有场景,主流大模型注入知识的路线各有硬伤。中科院和360AI联合团队提出GAG方案,无需检索、固定底座、单Token、即插即用,实验显示效果佳,也指出跨域组合等局限。

PaperAgent
推荐文章8

用子模优化做文本选择、段落重排和上下文工程

文章围绕子模优化展开,介绍其在文本选择、段落重排和上下文工程中的应用。指出当前重排器的缺陷,通过子模优化可解决冗余问题。还给出实验结果,凸显其优势,如理论保证、自动停止机制等。

Jina AI
新闻资讯8

对话景鲲:AI 产品的 All in One,是上下文的 All in One

Genspark 创始人景鲲在 AGI 舞台分享发展路径,其产品从 AI 搜索转型,现推出全功能 AI 办公套件。景鲲判断,未来大模型竞争激烈会商品化,AI 公司壁垒在于捕获用户工作上下文,实现「All in One」AI 工作空间。

Founder Park
算法论文8

刘鹏飞组发布上下文工程2.0:人机交互的全新视角

刘鹏飞组论文《Context Engineering 2.0: The Context of Context Engineering》重新梳理上下文工程领域。它追溯其20多年历史,给出形式化定义与四阶段模型,探讨关键问题,将其从技术技巧升为系统学科,为理解人机交互提供新视角。

深度学习自然语言处理
产品应用8

面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文

面壁智能团队提出SALA,基于此训练的MiniCPM-SALA模型,在单张A6000显卡实现百万token超长上下文推理,训练成本降约75%。它结合稀疏与线性注意力,采用混合架构,继承权重降低成本,在长文本处理上优势明显。

AIGC开放社区