「大模型记忆系统」共找到 9030 篇相关文章

开源动态8

Meta联手UCSD发布DeepConf:计算成本暴降85%,99.9%准确率!

Meta AI联合UCSD推出DeepConf技术,解决了AI高难度推理准确率与计算成本的难题。它让AI学会“察言观色”,筛选靠谱推理路径,在AIME 2025竞赛中与GPT - OSS - 120B模型取得99.9%准确率,还节省大量计算资源。

AIGC开放社区
新闻资讯8

7个月翻一番!AI agent能力飙升,METR报告揭示指数级进化规律

非营利研究机构METR报告显示,Agent能力每7个月翻一番,这在9项基准测试中得到验证,任务涉及编程、数学等领域,大模型正迈向高度自动化,且Agent性能提升快,未来处理复杂任务能力或更强。

量子位
推荐文章7

GPU到底是如何工作的?这篇AI Infra入门全部告诉你

本文详细介绍了GPU工作原理及编程模式。它从图形渲染发展到GPGPU,NVIDIA推动其通用计算。还阐述了CPU/GPU异构架构,对比二者性能,介绍编译、加载、启动过程,以及GPU硬件架构、编程与执行模型,分析SIMD和SIMT。

腾讯技术工程
产品应用8

Kimi新出的Agent集群,到底有多恐怖?

Kimi发布K2.5模型及Agent集群功能,将国产AI推向“组织智能”新高度。K2.5全能且开源,多项评测优于GPT - 5.2 - xhigh且成本低。Agent集群可按需协调子Agent,实现“角色涌现”与“3D编排”。

newtype AI
产品应用8

WAIC现场最“聪明”展台!AI眼睛耳朵能力全打开了

WAIC现场,声网展台被观众挤爆,其新奇“AI玩具”都能与玩家流畅对话。声网对话式AI引擎全新升级,新增选择性注意力锁定、视觉理解能力,能与主流数字人方案集成,还可接入大模型,价格低。它已在多领域落地。

量子位
新闻资讯8

对话许华哲:进家的机器人,先做好这10件事

本文是对许华哲的访谈,他离开星海图创办破壳机器人,切入具身智能C端赛道。许华哲阐述选择进家的原因、产品规划,还探讨数据来源、模型规划、强化学习等问题,分享从科学家到创业者的体验。

DeepTech深科技
算法论文8

LSTM之父Jürgen再突破,「赫胥黎-哥德尔机」让AI学会自己进化

LSTM 之父 Jürgen Schmidhuber 对 2003 年提出的哥德尔模型进行新尝试,构建赫胥黎 - 哥德尔机(HGM)。它能在 SWE - Bench Lite 媲美最佳人类设计智能体,还在多基准测试中超越现有方法,展现强大迁移能力。

机器之心
推荐文章7

AI 原生应用全栈可观测实践:以 DeepSeek 对话机器人为例

本文以 DeepSeek 对话机器人为例,介绍 AI 原生应用架构可观测需求、挑战与方案实践。分析 AI 领域痛点,提出阿里云 AI 全栈可观测架构,剖析大模型应用可观测技术,分享实战案例,还给出未来规划。

InfoQ
产品应用7

GPT-5 不是技术新范式,是 OpenAI 加速产品化的战略拐点

文章从不同视角评价 GPT - 5,指出它是 ChatGPT 产品重要升级,是 Router 驱动系统。介绍其能力提升与短板,如 Vibe coding 性价比高但 Agentic 能力不足,还探讨了商业影响、价格战等,期待其 Agentic 能力发展。

海外独角兽
产品应用8

实测腾讯首个 AI IDE 产品,小白也能『批量开发』微信小程序

2025年AI Coding领域竞争激烈,腾讯7月22日揭幕国内首款“产—设—研”全链路AI IDE CodeBuddy。它支持主流模型,能将想法转化提示词等,通过多个案例展示其强大功能,腾讯还计划让其普惠开发者。

鲸选AI