智能体记忆架构」共找到 5055 篇相关文章

产品应用8

Meta首个Agent生图模型登场,空降竞技场第二

Meta超智能实验室推出图像生成模型Muse Image,引入智能体机制,能编写代码、网络搜索,有自主修正能力,支持算力扩展、多轮编辑与画面合成。还预览了Muse Video,两模型均与Meta产品深度整合。

AI寒武纪
新闻资讯8

又一华为天才少年入局具身创业!用视频生成数据训家用机器人,首个模型登顶具身基模榜单

又一华为天才少年周凯文加入具身创企诺因智能。该公司成立不到一年,专注ToC家用具身智能机器人,用视频生成数据训练模型,其KnowinBrain模型登顶具身基模榜单,团队人才密度高。

量子位
新闻资讯8

领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%

Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新大模型扩展路径。

机器之心
算法论文8

超越MLA!新架构MLRA百万token,解码最高2.8倍速 | ICLR'26

大语言模型处理长文本时,自回归生成受限于显存带宽。为减少KV缓存开销,业界尝试多种方法,但MLA有缺陷。宾夕法尼亚州立大学等研究人员提出MLRA,拆分KV缓存为四个并行分支,降低显存占用,实现4路张量并行,性能更优。

新智元
新闻资讯8

刚刚,Anthropic分享了他们在AI Agents评估的最佳实践

Anthropic发布blog《揭秘AI Agents评估》,指出良好评估能助团队信心发布AI智能体,介绍评估结构、构建原因、评估方法、从零到一的路线图,还提到评估需与其他方法配合,全面了解智能体性能。

PaperAgent
开源动态7

本文关注vllm V1中管控模型分布式推理的Executor部分,介绍其类型、Executor-Workers架构及数据传输机制,对比V0架构优势,以单机多卡的MultiprocExecutor为例展开讲解,还提及不同数据量的传输方式及相关代码。

猛猿
新闻资讯8

Sam Altman:即将推出远超预期的开源模型,ChatGPT记忆功能正在实现《Her》的愿景

Sam Altman在对话中透露OpenAI将发布‘远超预期’开源模型,分享创立初期挑战,明确GPT - 5等演进方向,展望AI伴侣、机器人发展,还向创业者喊话,强调AI用于科学前景。

AI寒武纪
新闻资讯7

Agent 元年已至,我们会拥有自己的智能助理吗?|GAIR Live 预告

2024年被认为是「Agent元年」,智能体浪潮正改写工作与生活。6月14日上午10点,GAIR Live线上圆桌论坛将围绕「Agent」话题展开,5位一线嘉宾探讨其发展阶段、应用方向等关键议题。

AI科技评论
新闻资讯7

Claude强到不敢发的Mythos,被质疑用了字节Seed技术

Claude最强“神话”模型Mythos引发猜测,或用了字节Seed技术。社区热议其是否采用循环语言模型架构,关键线索来自Anthropic测试数据,在图搜索测试中Mythos优势明显,还有其他线索指向循环架构

量子位
新闻资讯8

情人节最硬核“Kiss”!中国AI突破300年亲吻数难题,连刷多维度纪录

中国AI打破300多年的亲吻数难题。上海科学智能研究院等团队提出PackingStar系统,刷新多维度世界纪录。它将难题转化为多智能体博弈,成果获高度评价,还体现了AI for Science 2.0特质。

量子位