大模型长期记忆」共找到 8107 篇相关文章

推荐文章7

为什么95%的智能体都部署失败了?这个圆桌讨论出了一些常见陷阱

硅谷圆桌论坛指出,95%的AI智能体部署失败,原因并非模型不智能,而是基础框架、上下文工程等未成熟。还探讨了上下文工程实践、信任治理、记忆设计、多模型编排等问题,给出创业者需思考的问题。

机器之心
算法论文7

AI 的“思维链”推理是海市蜃楼吗?

亚利桑那州立大学论文《大语言模型的思维链推理是海市蜃楼吗?》认为思维链推理在数据分布偏移时易出错,可能只是对训练数据模式的记忆。作者 Sean Goedecke 认为该论文结论不合理,从推理与语言、模型规模等方面提出反对意见。

宝玉AI
算法论文8

模型大一统?1100多个模型殊途同归,指向一个「通用子空间」!

约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间。此研究为神经网络参数空间“通用性”提供严谨实证,虽成因待探索,但意义深远。

AINLPer
新闻资讯7

黄仁勋倡议的开源联名信,Anthropic 为何不愿签名?

黄仁勋分享支持开放权重模型的联名信,NVIDIA、Google等公司联署,Anthropic缺席遭网友讨伐。Anthropic研究人员回应引争议,这场讨论或存在错位,分歧关键在于发布前评测能否支持模型权重长期外授。

AI科技评论
推荐文章7

编程智能体的核心组件【译】(重发,补图)

文章围绕编程智能体展开,先厘清大语言模型、推理模型与智能体关系,指出智能体是含‘模型 + 工具 + 记忆 + 环境反馈’的循环系统,后介绍编程智能体六大核心组件,还对比了与 OpenClaw 的区别。

宝玉AI
算法论文8

全球顶尖AI做物理,被人类按地摩擦?不懂推理大翻车,本科生碾压

港大等机构用3000道物理题测试顶尖大模型,如GPT - 4o、Claude 3.7 Sonnet等,结果模型准确率远低于人类专家。研究推出PHYX基准测试,揭示模型依赖知识、公式和模式匹配,缺乏真正物理理解。

新智元
推荐文章7

对话唐波 x 伍斌:OpenClaw 最强的地方,为什么也成了它最大的短板? | AI 进化论

本文聚焦 OpenClaw 引爆的智能体革命,对话专家探讨记忆系统及下一代 Agent 走向“长期主义”的底层逻辑。指出 OpenClaw 记忆起初是优势,后成短板,还讨论了从“记住”到“会用”、多 Agent 协作等问题。

AI科技大本营
新闻资讯7

谷歌神秘模型Kingfall泄漏!

近日,谷歌AI模型Kingfall在AI Studio平台短暂开放后意外曝光。它具备多模态处理能力,上下文窗口6.5万个token,有两种模式。生成SVG矢量图能力超Claude 4,身份猜测不断。

AI工程化
新闻资讯8

ChatGPT化身生活操作系统:奥特曼预告下一代顶级AI

在旧金山AI初创学校对话中,奥特曼宣布OpenAI计划发布强大开源模型,可本地运行。还谈到模型成本下降、ChatGPT记忆功能,以及GPT - 5等集成模型愿景,甚至称高级订阅将免费送机器人。

量子位
新闻资讯7

Claude还是最强,但Anthropic这周好像疯了

Anthropic状告阿里蒸馏模型致其股价创新低。一位87年创业者用AI搭工作流,起初用DeepSeek和Qwen问题多,换Claude后流程顺畅。MRCR v2测试显示国产模型与Claude有差距,便宜与省心模型该怎么选成问题。

探索AGI