长期记忆」共找到 725 篇相关文章

算法论文7

实证:现在的LLM根本不会Reasoning!

论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,有三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。

深度学习自然语言处理
产品应用7

Cursor 1.0 正式版来了!BugBot 代码审查、后台 Agent 全面开放、MCP 一键安装。

Cursor 1.0正式版更新,新增功能不少,如BugBot代码审查、记忆功能、MCP一键配置等。后台Agent全面开放,还支持Jupyter Notebook。不过新设置界面使用体验一般,远程开发时mcp配置有问题。

AI进修生
新闻资讯8

陶哲轩痛诉很缺钱!科研经费暴跌67%十年最低,自掏腰包科研

美国国家科学基金会削减基础科学资助,数学科学领域资助大降。菲尔兹奖得主陶哲轩痛诉经费不足,自掏腰包做科研,还以“开普勒的橙子”说明基础研究虽短期无用,却能助力科技突破。

新智元
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT会带来安全性能退化。

AI科技评论
产品应用8

Claude Opus 4.7发布:更严谨的长任务处理与自我验证能力

Anthropic发布Claude Opus 4.7模型,相比4.6版处理长任务更严谨,能自我验证输出。它在视觉、指令遵循、记忆等能力上提升,企业级应用表现出色,还有新功能与安全特性,不过使用成本更高。

AI工程化
算法论文8

CVPR 2026|AI开始会拍电影了:一分钟十镜头,全程不崩剧情

多镜头视频生成要求模型处理不同镜头间稳定信息和变化信息,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,建立跨镜头记忆机制,设计关键模块,实验表现好,为视频生成打开新可能。

机器之心
推荐文章8

没有KPI,也能领先OpenAI?从“内部观察者”视角看顶级AI实验室如何运作

InfoQ 采访《哈萨比斯:谷歌 AI 之脑》作者塞巴斯蒂安·马拉比,从“内部观察者”视角探讨 DeepMind 成长逻辑,分析其与 OpenAI、Anthropic 的差异,指出 AI 竞争已演变为组织模式等方面的长期博弈。

InfoQ
推荐文章8

没有KPI,也能领先OpenAI?从“内部观察者”视角看顶级AI实验室如何运作

InfoQ采访《哈萨比斯:谷歌AI之脑》作者塞巴斯蒂安·马拉比,从“内部观察者”视角解析DeepMind成长逻辑,探讨其与OpenAI、Anthropic差异,还谈及AI竞争格局、组织模式及资源配置等问题。

AI前线
开源动态8

钢铁版OpenClaw,Transformer作者用Rust打造,告别数据裸奔

OpenClaw开源后虽发展迅速,但存在严重安全问题,如数据明文处理、隐私保护缺失、恶意组件等。Transformer论文作者Illia Polosukhin用Rust打造IronClaw,重构底层架构,升级记忆引擎,还指向去中心化经济。

AIGC开放社区
算法论文8

Agent框架各自为战?谷歌&微软:用Agent-KB让经验自由流动

当前不同框架的Agent知识无法互通,谷歌、耶鲁、字节、oppo等团队联合提出Agent KB,这是通用记忆基础设施,能让异构Agent框架共享经验。它有师生双阶段检索机制,实验验证其能带来显著增益。

PaperAgent