记忆体系」共找到 1128 篇相关文章

算法论文8

EMNLP 2025 | T2R-bench: 业内「首个」工业级表格生成报告评测基准

中国电信人工智能研究院推出业内首个面向真实工业场景的“表格到报告”基准T2R-bench,涵盖多领域真实表格、问题与人工标注关键点,配套创新性三维度评测体系。实验显示主流大模型在该任务上表现欠佳,提升空间大。

AINLPer
产品应用8

一个人+Claude+云服务,相当于一整个工程团队

网上两个实操演示被疯转,一是Google Cloud工程师用Claude配合Google云部署应用;二是Anthropic Claude团队教搭建带持久记忆的AI智能体。博主整理7天实操计划,将Claude变“全自动AI雇员”,还介绍多种AI雇员类型及成本。

AI工程化
推荐文章8

还在拼命加 GPU?AI 应用规模化的下半场,拼的是这五大软件“新基建”

文章指出 AI 应用规模化下半场,拼的是五大软件“新基建”。从云原生到 AI 原生,应用基础设施面临诸多挑战,如从代码中心到智能体管理等。作者提出构建智能体协作网格、认知记忆平台等五座技术灯塔,助力 AI 原生应用发展。

InfoQ
8

520,遇见国产「新模王」Qwen3.7-Max!

在2026阿里云峰会上,阿里推出全新一代千问旗舰模型Qwen3.7 - Max。它在各类测评中成绩亮眼,性能直逼全球最强模型,还针对Agent优化。阿里全栈AI体系助力模型高频迭代,千问深耕开源社区,志在成为智能体时代基础设施。

机器之心
算法论文8

南大团队直击大模型高分神话:人类90分,最强模型仅49分

南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元
新闻资讯7

硅谷顶级团队闭门会,让Agent活下来的共识,95%的AI Agent都死了

旧金山AI技术大会上,企业大佬指出95%的AI Agent在生产环境中失败,活下来的5%符合5个共识,包括做好上下文选择系统、重视安全权限与用户信任、将记忆作为架构决策、多模型编排及合理运用对话与GUI等,还提及被低估的方向。

探索AGI
推荐文章8

LLM-based Agent的代码生成综述

这篇2025年的综述指出,传统代码生成技术难完成复杂开发任务,而基于大语言模型(LLM)的代码生成代理应运而生。它把LLM作为“大脑”,具备自主规划等能力。文章梳理了该领域的核心特征、技术体系、应用实践等,也剖析了挑战与未来方向。

深度学习自然语言处理
新闻资讯8

模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum

本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。

AI科技大本营
上一页113 / 113下一页