推理密集型信息检索」共找到 2635 篇相关文章

推荐文章7

大模型的第一性原理:(二)信号处理篇

本文从信号处理角度解读大模型原论文,探讨语义向量化原理,分析 Transformer 与 Granger 因果关系。指出大模型输入 Token 语义嵌入是将自然语言处理转化为信号处理问题,向量化与信号处理、信息论联系紧密。

机器之心
推荐文章8

解决算力瓶颈,给多模态瘦身!Token压缩完整图谱与选型指南

给多模态大模型瘦身是解决算力瓶颈的关键。Token压缩技术可剔除视觉冗余,提升训练与推理效率。北大等团队剖析其全貌,给出完整图谱与选型指南,还揭示了未来演进路径。

AIGC开放社区
推荐文章7

企业级 AI Agent 的终极王牌:从 0 到 1 带你理解 “本体论” 与 6 块核心“积木”。

文章指出大部分企业Agent项目因幻觉、跑偏等问题失败,引出基于“本体论”的企业“本体”工程。介绍企业AI困境、现有工程手段不足,阐述本体可补企业“语义层”及构建本体的6块核心“积木”。

AI大模型应用实践
新闻资讯7

GPT-5.3爆更前夜,全网都被一张图吓到!ChatGPT人格大赏

OpenAI华人研究员Joanne Jang一条推文引发ChatGPT生图玩法热潮,它能根据聊天记录生成反映‘待遇’的自画像。近期ChatGPT记忆功能优化,已向全球Pro和Plus用户推出。还有爆料称GPT - 5.3要来了。

新智元
算法论文8

GAG:超越RAG,无需检索的私有知识注入新范式

在高价值私有场景,主流大模型注入知识的路线各有硬伤。中科院和360AI联合团队提出GAG方案,无需检索、固定底座、单Token、即插即用,实验显示效果佳,也指出跨域组合等局限。

PaperAgent
算法论文8

一夜200万阅读,OpenAI神同步!这项测评框架让全球顶尖LLM全翻车

中国团队领衔全球24所高校机构发布评测LLMs for Science能力的论文,一夜阅读近200万,同一时间OpenAI也发文指出现有评测标准在AI for Science领域失灵。论文推出评测体系SDE,发现主流大模型在科学发现上短板明显。

新智元
新闻资讯7

AI安全的过去与未来:从大模型到智能体 | 预约

业界提升前沿AI模型和智能体安全性,常用安全评测和‘安全对齐’技术,但未真正解决风险。本次分享将介绍‘内生安全’探索成果,还公布了相关论文信息,刘东瑞等嘉宾将参与。

深度学习自然语言处理
推荐文章7

看完 Manus、Cursor 分享后的最大收获:避免 Context 的过度工程化才是关键

上下文工程优化是Agent创业公司新一年竞争重点,其信息质量很大程度决定Agent表现。文章结合Manus、Cursor团队思路,给出做好上下文工程要点,如缩减上下文、搭建工具行动空间、多Agent协作等。

Founder Park
推荐文章8

LightX2V fp4 quant kernel代码笔记

这是关于 LightX2V 里 `lightx2v_kernel` 做 FP4 量化 GEMM 的读码笔记,解释接口和约束、kernel 关键路径等问题,还介绍 NVFP4 和 MX-Formats 量化原理、代码实现,以及 LightX2V 项目中的实际使用。

GiantPandaLLM
产品应用8

ChatGPT Health重磅登场:可连接病历和Apple Health,打造专属健康助手

OpenAI推出ChatGPT Health,可连接病历和健康应用,基于用户健康信息回应。它有强化隐私保护,与医生合作设计,不取代医疗护理。先向部分早期用户开放,后续将面向网页和iOS用户。

AI寒武纪