长时记忆」共找到 1637 篇相关文章

新闻资讯7

Meta 143亿挖角后首个作品来了:Alexandr Wang 推出闭源模型,杨立坤点赞

沉寂9个月后,Alexandr Wang带队的Meta发布新一代模型Muse Spark。它是原生多模态推理模型,性能媲美Gemini Pro和GPT 5.4,Meta还披露技术实现细节。不过闭源引争议,且模型在程智能体等方面有短板。

AI前线
开源动态8

Code Arena全球可用模型第一!智谱GLM-5.2上线并开源

智谱上线并开源GLM-5.2,在Code Arena等平台表现优异,任务跑分出色,架构有突破,支持100万token上下文,还引入控制功能。模型在常用编程智能体可用,适配国产算力平台,以MIT协议开源。

AIGC开放社区
算法论文8

ICML 2025 | 无需训练,即对齐大模型偏好

上海人工智能实验室提出TPO方案,可让大模型在推理快速对齐人类偏好,无需更新模型权重。TPO类似文本形式的梯度下降,在多个基准数据集评测中表现出色,还提供“宽深结合”推理拓展策略。

深度学习自然语言处理
推荐文章7

为什么95%的智能体都部署失败了?这个圆桌讨论出了一些常见陷阱

硅谷圆桌论坛指出,95%的AI智能体部署失败,原因并非模型不智能,而是基础框架、上下文工程等未成熟。还探讨了上下文工程实践、信任治理、记忆设计、多模型编排等问题,给出创业者需思考的问题。

机器之心
开源动态8

1.2K Star!终于有工具开始认真解决 AI Agent 安全问题了!

作者深度使用AI Agent担忧其安全性,GitHub上斗象科技开源的ClawVault项目,上线不久获1.2K Star。它为AI Agent提供多场景安全隔离方案,有分格管理、可视化监控等实用设计,适配Python3.10+环境,安装方便。

开源星探
算法论文8

大模型如何"不训练"也能学习?——上下文学习的隐式权重更新机制

大型语言模型能通过上下文学习(ICL)在推理学习新任务,无需修改模型参数。本文首次证明自注意力层与MLP层组合能隐式将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。

深度学习自然语言处理
新闻资讯7

因为不用AI写代码,我在终面挂了 | 一个程序员的奇葩面试经历

外国小哥面试终面,因表示工作不优先用AI,5分钟后收到拒信。此经历在网上引发讨论,网友看法不一,有人支招面试别贬低AI,也有人探讨AI在编程中的利弊,还提到AI辅助面试应用。

量子位
产品应用7

2025 社交新方式:当 AI 成为「第二个我」,去实现「真实连接」

作者作为业余AI产品经理,体验Second Me这款AI应用。它能借助AI复刻「AI自我」,基于记忆匹配社交,作者借此完成与他人的深度交流。同探讨了AI社交风险,认为AI应是社交起点,帮人筛选和破冰。

特工宇宙
产品应用7

不吹不黑,GPT-5代码能力究竟怎么样?跟 Gemini 和 Claude 的对比测试给你答案

作者测试了 GPT-5 的代码能力,并与 Gemini 和 Claude 对比。在不同代码任务中,各模型表现不同。如在生成网页任务里,GPT-5 部分结果不错,但受 32K 上下文限制,文本处理不如 Gemini,硬实力也不如 Claude。

歸藏的AI工具箱
产品应用8

马斯克AI女友直播「一秒变身」,Karpathy看完立刻投钱

世界首个支持直播推流的「实」扩散AI视频模型MirageLSD诞生,大神Karpathy亲自站台。它能理解真实视频后同步生成AI视频,实现零延迟、无限、每秒24帧不卡顿,给视频娱乐和直播互动带来丰富想象。

新智元