记忆搜索」共找到 925 篇相关文章

算法论文8

从视觉压缩,到视觉记忆:MonkeyOCRv2以重建保留文档页面证据

文档视觉编码器对LLM理解和推理很重要。MonkeyOCRv2提出‘重建即文档视觉记忆’,通过多组实验验证其有效性,还发布MonkeyDoc v2数据集,推动公平比较的研究文化。

机器之心
新闻资讯7

苹果计划明年为Siri引入AI搜索功能,可能采用Gemini模型

据彭博社报道,苹果计划明年为Siri引入AI驱动的网络搜索功能,称“世界知识答案”,将以多媒体形式汇总结果。苹果正测试Google模型,或由其提供支持,此前还考虑过Anthropic的Claude模型但未达成协议。

AI工程化
新闻资讯8

I/O大会开完,谷歌连搜索框都变智能体了

当地时间周二谷歌I/O大会举行,转型智能体时代。谷歌推出Gemini 3.5系列模型,轻量级3.5 Flash已开放,重量级3.5 Pro仍在开发。还发布全新AI智能体Spark,改造谷歌搜索,推出多模态模型Gemini Omni。

机器之心
开源动态8

字节推出X-Streamer,实时口型同步与长程记忆数字人框架

字节推出端到端多模态人类世界建模框架X - Streamer,能从单张人像构建可无限流式生成的数字人,实现音素级口型同步和长程记忆。其核心是“思考者–行动者”双Transformer架构,在两张A100 GPU上可实时运行。

带你学AI
新闻资讯8

刚刚,ChatGPT免费模型升级了:幻觉砍半/记忆更强/回答更简洁

ChatGPT默认模型升级为GPT - 5.5 Instant,免费用户可用。它幻觉减少52.5%,新增“记忆来源”,答案更简洁,语气更温暖自然。从5月5日起向所有用户滚动上线,替代GPT - 5.3 Instant。

量子位
算法论文7

告别RAG相似匹配!百度Agentic-R为多轮搜索重塑检索器

传统检索增强生成(RAG)有“单跳”局限,多跳推理易出错。人大高瓴与百度提出面向智能搜索的检索器训练框架 Agentic - R,采用双视角打分和双向飞轮模式,在多数据集上表现出色。

PaperAgent
开源动态8

字节Seed开源长线记忆多模态Agent,像人一样能听会看

字节Seed发布全新多模态智能体框架M3 - Agent,能听会看、有长期记忆且免费开源。团队还开发新长视频问答基准M3 - Bench并开源。实验显示,M3 - Agent在多基准测试中显著优于基线模型。

量子位
算法论文7

基于Memory Bank的Cursor长会话记忆内存库理论研究与实践

文章围绕Memory Bank展开,介绍其为解决大模型长会话记忆瓶颈而设计的机制,包括存储、检索、更新模块。阐述其在编程和知识库建设的应用,还评测了Codelf等工具,指出Memory Bank是AI迈向智能的重要一步。

阿里云开发者
算法论文8

SearchAgent-X: 打破效率桎梏,释放下一代「AI搜索智能体」的真正潜能

论文提出SearchAgent-X框架解决AI搜索智能体效率难题。研究剖析效率瓶颈,发现精度和延迟问题,提出优先级感知调度与无停顿检索技术,经评估大幅提升性能且不牺牲答案质量。

PaperAgent
产品应用8

动动嘴写SQL!Codex+终身记忆,OpenAI把查询难度直接归零

2026年初,OpenAI曝光数据分析智能体,将数据查询从「天数级」缩至「分钟级」。它用Codex驱动,有六层上下文架构,能补齐数据语义、沉淀经验记忆,让工程师提问取代手动查表。

新智元