状态锚点」共找到 943 篇相关文章

推荐文章7

CAG又回来了,这次它带着RAG!

文章对比CAG和RAG,指出CAG虽解决RAG部分痛,但有根本限制,对海量变化知识库,RAG不可替代。Aurimas将二者结合做「动态混合层」效果好,还给出实施架构和关键

AI工程化
新闻资讯7

Anthropic 技术栈里的「五宗罪」由何而来?

Anthropic的Claude模型升级后,用户却觉得不好用。X上帖子指出其存在文本和代码标记、模型能力、定价、长上下文等问题,这些问题卡在生成、计算、上下文和Agent运行时的5个具体位置,导致各方面互相拖后腿。

AI科技评论
算法论文8

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

随着模型规模增长、新应用兴起,大模型基础设施面临管理「张量状态」挑战。北大、阶跃星辰与北邮联合提出 TensorCast,解耦张量状态,复用管理能力,在多场景测试中表现出色,为大模型基建提供新范式。

机器之心
新闻资讯7

千问:阿里第二次“无线战争”

本文以乔布斯用 iPhone 咖啡引出当下科技圈流行发布会咖啡展示 AI 能力,对比过去与现在,指出数字世界核心范式从移动转向 AI。介绍阿里千问饱和式投入情况,还分析其可能借鉴拼多多、抖音策略,站在长尾对立面。

乱翻书
开源动态8

夯,开源 LiteParse,没有对手的 PDF 解析工具,知道的太晚了!

LlamaIndex团队开源独立工具LiteParse,用Rust打造,可本地运行、零成本、高精度解析PDF。它能提取文本及精确位置,有多种输出格式,支持多格式输入,还介绍了安装、使用、OCR配置等内容及应用场景。

小华同学ai
产品应用7

Claude Code 新增 Recap 功能,多开党必备神器

Anthropic更新Claude Code,新增Recap功能。切回窗口时,它自动显示摘要,告知操作进度、问题及下一步计划,解决多开党忘记进度的困扰,目前已在终端版上线。

AGI Hunt
推荐文章8

Karpathy又封神!掀翻RAG,把你的笔记变成第二大脑

前OpenAI创始成员Andrej Karpathy提出让大模型把笔记「编译」成持续生长的活Wiki,替代RAG。他将笔记当源代码,LLM当编译器,实现知识结构化。此方案降低维护成本,解放人类注意力。

新智元
算法论文7

复旦等推出「第一人称视听基准」,补齐多模态模型「听觉拼图」

多模态大模型在真实世界会“失聪”,现有第一人称视频问答/理解基准长期偏“视觉中心”。复旦等团队推出首个系统评测第一人称声音理解能力的基准EgoSound,能让模型听懂世界,评测显示当前模型与人类差距大。

量子位
推荐文章7

The Batch: 894 | 面向生物医学的多模态模型

过去几年联合推理模型进展快,但生物医学领域能力碎片化、脆弱或难解释。2026 年,学术界应推进多模态模型建设,关注深度整合、可解释性、数据效率和适应性及模型在工作流中的整合。

DeeplearningAI
开源动态8

无痛使用vLLM的工具来了!

vLLM功能强大但上手门槛高,开源项目vLLM Playground是界面化工具,能解决使用难题。它零配置,集成官方vLLM recipes,内置性能测试,安装简单,对业务团队很友好。

AI工程化