上下文增强」共找到 1014 篇相关文章

算法论文8

美团提出多模态推理新范式:RL+SFT非传统顺序组合突破传统训练瓶颈

美团研究者提出Metis - RISE框架,将RL激励和SFT增强以非传统顺序结合提升多模态大语言模型推理能力。先RL激发潜能,再SFT补齐短板,训练的两模型在OpenCompass榜单成绩优异。

量子位
推荐文章8

程序员的提示工程实战手册

文章围绕程序员如何利用提示工程让AI编程助手成为可靠开发伙伴展开。介绍给AI代码助手的提示词技巧、高效代码提示原则,还阐述调试、重构、实现新功能的提示模式,指出常见反模式及应对方法。

宝玉AI
算法论文7

利用大模型检测钓鱼邮件:方法,效果及数据集

随着企业安全防范增强,钓鱼邮件成重要攻击手段,大模型检测方法盛行。日本论文详细披露检测方法和实验数据,含解析解码、简化邮件、生成prompt、调用LLM四步,还介绍数据集及评估了四个模型效果。

AI与安全
新闻资讯7

80亿美元押注Agent!全球第一CRM收购Informatica

昨晚,全球第一CRM平台Salesforce宣布以80亿美元全资收购Informatica,增强其数据基础,利于部署AI Agent。Salesforce高管认为二者结合能打造全面数据平台。Salesforce早布局Agent,其自研平台Agentforce应用效果显著。

AIGC开放社区
推荐文章7

Transformer | 一文带你了解Embedding(从传统嵌入方法到大模型Embedding)

文章介绍Embedding基础知识,从传统统计方法到如今大模型用例演变过程。涵盖传统、静态、上下文及大模型Embedding技术,如TF - IDF、word2vec、BERT等,还剖析DS - Qwen1.5B的Embedding并以图展示。

AINLPer
开源动态7

小米MiMo Agent 跨会话进化

多数AI编程Agent任务一长就忘事,业界主流靠堆上下文窗口应对,但有缺陷。小米MiMo团队开源的MiMo Code,靠显式存储 - 检索机制,200步以上任务胜率超Claude Code达65%,介绍了其设计及优缺点。

CourseAI
产品应用7

别再错过啦,AI Agent记忆革命:95.2%检索率的持久记忆系统深度解析

agentmemory是为AI编码Agent打造的持久记忆系统,能自动捕获操作上下文,有三层搜索与四层记忆架构。支持12+种主流AI Agent,有全平台覆盖、零外部依赖等优势,虽有局限但值得开发者一试。

小华同学ai
算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种后训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。

量子位
新闻资讯8

从「自我进化」到「DAA」,百度给出 Agent 时代系统答案

2026 年 AI 行业发展微妙,模型能力增强但转化为生产力的企业不多。Create 2026 上百度给出两层答案,构建系统能力,提出 DAA 度量 AI。这是过去三年判断的收束,将非共识整合成面向 Agent 时代的方法论。

AI前线
算法论文8

ACL 2026|Doc-V*:读100页文档不如只翻对5页,80页场景「暴打」RAG 10个点

Doc-V*由小米和华中科技大学团队提出,是多页文档理解新范式,通过交互式视觉推理让模型有策略地读长文档。它在多页文档问答基准上比RAG变体提升49.7%,不依赖大模型或长上下文窗口。

机器之心