「原生检索增强推理」共找到 1074 篇相关文章
Vercel 开源 Bash 工具:基于本地文件系统的上下文检索
Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。
Qwen-Image-Edit 更新:多图编辑支持,单图一致性增强
阿里8月发布的Qwen-Image-Edit迎来月迭代版本Qwen-Image-Edit-2509,可在https://chat.qwen.ai/使用。更新支持多图编辑,有多种玩法,还提升单图一致性,在人物、商品、文字编辑上表现显著。
LLM的快速、慢速与工具增强思维模式综述
大型语言模型在不同任务中对推理策略需求差异大,策略选择不当会影响效率与可靠性。本文提出双重知识边界框架,梳理LLMs推理模式,将策略选择形式化,还分析了决策因素及策略选择机制。
微调重要表征以增强思维链的推理能力
团队提出关键表征微调(CRFT)方法,通过信息流分析识别和优化关键表征。在八个数学和常识推理基准及两个模型系列验证其有效性,能提高推理准确率,学习参数量低,还适应少样本场景。
28.2k+ star,这个终端历史增强神器绝了!
开源君发现开源Shell历史管理工具Atuin,它用Rust编写,将命令结构化存到SQLite数据库,记录丰富上下文信息。兼容主流Shell,有专属搜索UI,功能强大,安装方便,提升命令行历史体验。
Manus走了,原生Agent登场:“AI助手”的第三次重新定义
文章回顾“AI助手”三次预期校准,指出Manus完成Agent启蒙使命,随后分析Agent发展现状,提到其将从炫技到日常,还指出Chat时代落幕,中国模型创业者正加速,探索谁能成“中国的Anthropic”。
SGLang支持GPT-OSS:从Day 0支持到性能增强
SGLang宣布重大更新,聚焦openai/gpt - oss - 120b模型深度性能优化与新功能。预填充和解码阶段吞吐量显著提升,支持多GPU,有推测解码等功能,还支持智能体应用程序,且不损害模型推理能力。
全球云数据库巨头收购Crunchy Data,增强AI Agent能力
全球云数据库巨头Snowflake宣布收购Crunchy Data,发布新型Postgres数据库Snowflake Postgres,满足企业级AI和事务系统需求,具有安全合规等特点,有三大特色功能,推动其成为企业数据负载目的地。
开源SOTA!商汤原生多模态一个大脑完成看图、推理、作画
商汤开源日日新SenseNova U1,用NEO - unify架构让像素和文字自由协作,多项指标达开源SOTA,适配10家国产芯片。它能完成看图、推理、作画等多任务,虽有局限,但后续优化值得期待。
ERNIE 5.0:走向原生统一的万亿参数多模态基础模型
过去多模态模型‘拼接式’方案存在理解与生成割裂问题,ERNIE 5.0 借此提出,用统一自回归框架做多模态理解与生成,在架构、训练与系统层面有创新,评测中各模态能力表现出色。