「超长上下文测试」共找到 2297 篇相关文章
突破传统检索瓶颈!阿里通义实验室发布 WebDancer,开启多步推理智能体新范式!
在信息爆炸时代,传统检索技术缺乏动态决策能力,难以满足多步推理需求。阿里通义实验室发布的 WebDancer 基于 ReAct 框架,通过四阶段构建,在测试中表现优异,未来规划拓展工具生态、突破任务边界等。
独家丨MiniMax 高级研究总监钟怡然已于半年前离职
AI 科技评论独家获悉,MiniMax 高级研究总监钟怡然已离职,去向未公开。他曾主导设计 MiniMax - 01,该模型在超长上下文处理能力上表现突出,走出独特架构创新与效率优化路径。
CC&LG实践|基于 LangGraph 一步步实现 Claude-Code 核心设计
本文深入剖析Claude - Code核心设计与关键技术,结合LangGraph框架,从基础ReAct Agent构建简版Claude - Code,涵盖人工审查、SubAgent实现、任务管理、上下文压缩等多方面,还提及流式响应升级及相关对比。
详细介绍!RAG 和 GraphRAG:了解何时(When)、如何(How)使用它们
文章详细介绍传统RAG和GraphRAG技术,前者通过向量搜索检索上下文,但无法体现数据关系;后者用知识图谱提升检索效果,亮点是构建图谱、整合信息。还指出两者优缺点,建议结合使用。
这家 AI Lab 宣布所有模型无限期免费后,我顺手做了个图片版番茄钟
全球排名前十的 AI Lab,Agnes 宣布旗下核心全模态模型 API 无限期免费开放,包括文本、图片、视频。还新增百万 Token 上下文和 4K 图片生成功能。作者用其做了图片版番茄钟,官方也公开开发进度。
两个浙大学生决定只用AI生存72小时|甲子光年
五源资本发起“72小时AI生存挑战”,浙大学生区瀚楠、陈睿轩参与。他们在封闭房间用AI工具生存72小时,先搭建Agent购得物资,后尝试用AI赚钱未成功。此活动灵感源于99年“72小时网络生存测试”。
商汤SenseNova U1深度拆解,原生统一架构终结缝合时代
文章深度拆解商汤科技开源的新一代模型「日日新 SenseNova U1」,介绍其基于 NEO - Unify 原生统一架构,在数据、训练与推理深度协同,多维度测试成绩亮眼,代表多模态从拼接走向原生建模新方向。
拼交付、主动找活干,3 月我们推荐这 18 款 Agent 产品
3月是AI产品发布密集期,出现一批主动干活的Agent产品。文章介绍18款产品,如Claude系列升级为个人AI操作系统,OpenClaw生态涌现多种商业形态,还有垂直场景Agent及上下文感知等产品。
2.1K Star!这个 Claude Skills 技能库,给 AI 编程助手装上了 66 颗专家大脑!
GitHub上的开源项目claude - skills迅速走红,斩获2.1K Star。它是全能技能注入包,内置66种专业技能,覆盖12个领域,有300多份深度参考文档,具备上下文感知能力,还整合9套工作流,安装方式多样。
多模型共享 GPU 内存,Berkeley 开源新工具
GPU内存利用率低是大模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟化技术让多模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容性好。