RAG评估机制」共找到 1713 篇相关文章

推荐文章8

Anthropic:这样构建Agent,性能提升90%!

Anthropic分享从0到1构建多智能体DeepResearch系统的方法,该系统是Claude内置Research功能。干货多,涵盖架构设计、Prompt工程等。多智能体性能比单模型高90.2%,但烧钱,适合高价值复杂任务。

探索AGI
算法论文8

医学领域也有世界模型了:精准模拟肿瘤演化,还能规划治疗方案

来自多机构学者联合提出医学世界模型(MeWM),赋予AI“预演”疾病发展的能力。它能模拟肿瘤演化,为个性化治疗提供辅助,有肿瘤演变模拟、生存风险预知和临床决策闭环三大核心功能。

量子位
新闻资讯7

危险?OpenAI 模型行为负责人:人类很快会进入「AI意识」,当前最重要是控制人机关系的影响

OpenAI模型行为与政策负责人Joanne Jang发文指出,与其争论AI是否有意识,不如关注其对人类“情感福祉”的影响。文章探讨了OpenAI在人机关系上的处理,以及如何塑造模型行为,还提及未来计划。

AI寒武纪
算法论文8

首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。

量子位
产品应用8

证明也有「选择困难症」?腾讯AI Lab与大模型研究部联手打造 MPS-Prover ,多视角破解形式化推理瓶颈!

本文聚焦逐步式自动化定理证明器困境,腾讯AI Lab等提出MPS - Prover。它有数据筛选和多视角树搜索两项创新,提升搜索效率和证明质量,在多基准表现佳,还解决六道IMO难题。

AI科技评论
开源动态8

AI开始玩乐高了?我拼一小时的乐高,它几秒就搭好,LegoGPT开源了!

卡内基梅隆大学提出LegoGPT,是首个依文本提示生成物理稳定乐高积木模型的方法。构建了StableText2Lego数据集,训练自回归大模型生成设计,还开发纹理生成法,设计能手动或机器人组装。

带你学AI
产品应用7

可塑的计算机Omarchy爆火硅谷,龙虾之父自掏100万投资

Ruby on Rails 作者 DHH 推出 Linux 发行版 Omarchy,将 AI agent 嵌进系统底层,有独特设计和功能。自带安装脚本,安装快。获十位大佬各 100 万美元赞助,多家系统也在探索 AI 嵌入,它有望开启 Agent OS 时代。

AI工程化
开源动态7

惊讶!!!3.2 万 Star OpenViking,让你的原地起飞!!!

OpenViking有3.2万Star,它把记忆、文档、提示词等上下文统一成可浏览地址空间,设计三层信息按需加载,检索留轨迹,还接入多种工具。不过它处Alpha阶段,用前要考虑许可证。

小华同学ai
新闻资讯8

成果三年两登Nature封面,这支清华团队想让AI换个方式看世界

清华大学类脑计算研究中心团队成果三年两登Nature封面。晰见科技承接天眸芯技术产业化,重新做AI的眼睛。天眸芯拆解视觉信息,构建互补通路,团队还研究算法融合信息,目前芯片进展良好。

DeepTech深科技
开源动态7

DeepSeek推理再提速80%,V4正式版定档7月中旬

DeepSeek两天前开源DSpark推理加速框架,已在V4预览版在线服务跑真实流量,使生成速度提升60% - 85%。DSpark化解推测解码问题,在多模型超Eagle3和DFlash。V4正式版7月中旬上线,将引入峰谷定价。

AIGC开放社区