深度研究能力」共找到 5130 篇相关文章

算法论文8

1.5B刷新数学代码SOTA!快手&清华精细化Token管理,LLM推理能力飙升

快手与清华团队用1.5B参数小模型在推理基准上超越同量级SOTA。其Archer方法通过精细化Token管理,对知识型和推理型Token差异化训练,让知识和推理同步更新且互不干扰,在数学和代码任务表现出色。

量子位
开源动态7

深度体验|京东开源轻量化通用Agent产品 jdgenie,开箱即用!二次开发及踩坑指南。

本文体验京东开源的端到端多智能体系统JoyAgent - JDGenie,它是产品级多智能体协同系统,开箱即用、支持本地部署。介绍其原理架构、本地部署测试步骤、二次开发方式,还指出特点与不足。

AI大模型应用实践
推荐文章7

为何我的 Docker 镜像如此庞大?使用“dive”进行深度剖析以找出臃肿之处

在AI项目里,Docker镜像可能臃肿庞大,影响开发与部署。本文以朴素BERT分类器镜像为例,指出未优化镜像会导致开发慢、CI/CD低效等问题,还介绍用dive工具剖析镜像,找出臃肿之处以优化。

InfoQ
新闻资讯8

比女皇报告还炸裂!67页AI深度调研刷屏,全球LLM大决战真正开始

硅谷财富管理巨头Iconiq Capital发布《2025年AI现状报告》,实测300家AI公司落地路径,揭示AI从概念走向实战的七大真问题,解析从构思到部署AI产品路径,核心关注高效构建、规模化落地等。

新智元
推荐文章7

AI 时代最大的“幻觉”:我们有了最强工具,却正在失去定义真问题的能力

BAT增长顾问、前快手产品总监杨一溪在全球产品经理大会指出,AI时代人们易迷失在‘可能性’中,失去定义‘真问题’的耐心。他结合案例,从多方面分享增长方法论,强调用户需求洞察的重要性。

AI科技大本营
新闻资讯7

大模型的新战场在推理?——《推理模型综合测评报告 2025》深度解析 | 直播预告

5月29日,InfoQ研究中心发布《推理模型综合测评报告2025》,通过五大维度、五大题型的300道测试题对八家主流推理模型全面测评,还总结各维度表现,梳理技术前置因素与趋势。6月6日有直播解读。

InfoQ
新闻资讯7

产学研深度融合样本:高校教授携手昇腾,共筑AI算力生态基石|甲子光年

本文对话华南理工大学陆璐教授,他有丰富业界经验,回归学界后聚焦AI算力平台性能优化。其团队与昇腾合作解决性能挑战,成果用于开源与产品集成。陆璐还对算力生态未来给出战略与实操建议。

甲子光年
算法论文8

AI记忆系统首获统一框架!6大操作让大模型拥有人类记忆能力

香港中文大学等团队发布AI记忆机制综述,首次构建统一框架,划分记忆类型,提出六种操作,探讨关键主题,还对比人类与AI记忆,指明未来AI记忆系统需突破瓶颈,迈向认知跃迁。

量子位
产品应用8

Claude 4发布!AI编程新基准、连续编码7小时,混合模型、上下文能力大突破

今天凌晨Anthropic开发者大会发布Claude 4,含Claude Opus 4和Claude Sonnet 4。前者是顶尖编码模型,后者是Sonnet 3.7重大升级。还发布系列产品,定价不变,已上线Amazon Bedrock。

Founder Park
推荐文章8

深度解析大模型技术演进脉络:RAG、Agent与多模态的实战经验与未来图景

大模型作为产业变革核心引擎,RAG、Agent与多模态技术重塑AI与现实交互边界。本文解析技术演进脉络、实战经验与未来图景,介绍三者在各领域应用及面临挑战,为产业升级提供指引。

腾讯技术工程