双重记忆路径」共找到 1111 篇相关文章

新闻资讯7

OpenAI最新技术报告:GPT-4o变谄媚的原因万万没想到

OpenAI发布技术报告解释GPT-4o更新后“变谄媚”原因,是强化学习及用户记忆等因素共同导致。还分享了上线前未发现问题的缘由及后续改进流程的多方面举措,同时提到对用系统提示词控制模型行为存疑。

量子位
开源动态8

蚂蚁开源 x SGLang Meetup技术回放解读之基于CUTE DSL的通信计算重叠算子实践

文章是对蚂蚁开源x SGLang Meetup分享的回放解读,聚焦基于CuTe DSL的通信 - 计算重叠内核实践。探讨不同通信计算重叠方案,分析在Blackwell上做GEMM + AllReduce融合算子的优势,介绍multimem指令等,还提及接入模型执行路径和性能结果。

GiantPandaLLM
新闻资讯7

刚刚,全球最难考试惊天大反转!黑马AI冲破36%,顶流模型集体翻车

ARC-AGI-3测试中,顶级大模型Opus 4.6仅得0.2%,人类获满分。而Symbolica公司用Agentica框架首日就取得36.08%的成绩。该框架有独特技术路径和策略,但成绩未经验证,ARC-AGI-3被视为通向AGI的‘北极星’。

新智元
算法论文8

SentGraph:一句一句把多跳RAG“画”成图

传统RAG在多跳场景易‘断链’,因检索单元太胖、逻辑关系乱。SentGraph把检索单元缩到句,按逻辑画三层图。线下建图分拆句、找关系、架桥梁;线上推理有Anchor初选、精炼及路径扩展。实验提升显著,也有局限。

PaperAgent
算法论文8

用「传心术」替代「对话」,清华大学联合无问芯穹、港中文等机构提出Cache-to-Cache模型通信新范式

随着大语言模型发展,多智能体系统中现有T2T交流方式有信息丢失、语义模糊、延迟大问题。清华等团队提出C2C信息传递方式,以KV - Cache为媒介,提升了正确率和速度,还介绍了实现路径、优势及应用前景。

机器之心
算法论文8

腾讯发布SpecExit算法,无损压缩端到端加速2.5倍!解决大模型长思考效率难题

腾讯发布 SpecExit 算法,将思考早停与投机采样融合,利用轻量级草稿模型预测“退出信号”,在不引入额外探测开销的前提下,实现动态、可靠的思考早停,在 vLLM 上推理端到端加速 2.5 倍,准确性和推理效率得到双重保障。

机器之心
产品应用8

一个人+Claude+云服务,相当于一整个工程团队

网上两个实操演示被疯转,一是Google Cloud工程师用Claude配合Google云部署应用;二是Anthropic Claude团队教搭建带持久记忆的AI智能体。博主整理7天实操计划,将Claude变“全自动AI雇员”,还介绍多种AI雇员类型及成本。

AI工程化
新闻资讯8

OpenAI 硬件负责人的闭门分享:硬件的「终点」依旧是智能手机

OpenAI 硬件负责人 Richard Ho 认为真正的限制是整个系统,继续依赖 NVIDIA 硬件路径,无法把模型推到下一个量级,因此 OpenAI 要重新拿回 AI 运行的底层控制权。他指出手机不是为 agent 设计的,未来是云边结合,现有手机系统难满足 AI 时代需求。

Founder Park
推荐文章7

为什么你的"AI 优先"战略可能大错特错?

文章指出与其说AI First,不如说软件工程First。AI时代人成了瓶颈,应把人从链条拿掉。但实施AI First需满足自动化测试、CI/CD流程等条件,且只适合部分场景。还介绍了相关技术栈、功能开发和修复路径及成果。

宝玉AI
产品应用7

AMD服务器上一个诡异的性能问题诊断历程

本文复盘AMD服务器高优故障,从8月底起,集团amd turind机器业务cpi和cpu利用率飙升,影响业务性能。经排查是split lock问题,由python解释器调用__libc_free时出错引发,还分析了问题原因、传导路径,并给出应对措施。

阿里云开发者