记忆问题」共找到 3597 篇相关文章

新闻资讯8

AI能改10万行代码,却让你走路去洗车!Karpathy戳破「锯齿状智能」

Karpathy在Sequoia AI Ascent 2026炉边谈话指出,AI能力呈锯齿状,背后是经济学问题。他还提及软件新地平线,认为Vibe Coding抬高编程地板,专业开发需智能体工程,人类在智能体时代是工程导演。

新智元
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT会带来安全性能退化。

AI科技评论
算法论文8

让方程发现走向超大规模系统——《Predicting Dynamics of Ultra-Large Complex Systems by Inferring Governing Equations》精读笔记

论文《Predicting Dynamics of Ultra-Large Complex Systems by Inferring Governing Equations》提出Sparse Identification Graph Neural Network(SIGN),将方程发现工作流重新安排,在多类系统实验中展现可扩展性与长期预测能力,还在海表温度数据中恢复出共享动力学表达。

力学与人工智能
新闻资讯8

给AI发100美元去二手市场捡漏,结果它给自己买了19个乒乓球

2025 - 2026年,Anthropic进行“Project Deal”实验,让69个Claude智能体在真实双边市场自主交易,完成186笔超4000美元交易。实验发现模型能力影响交易结果,还揭示了AI代理交易存在的问题和隐忧。

DeepTech深科技
产品应用8

奥特曼亲自上阵,Images 2.0登顶王座!大米刻字,生图跨入GPT-5时代

OpenAI上线ChatGPT Images 2.0,奥特曼称其是从GPT - 3到GPT - 5的飞跃。它是首个‘会思考’的图像AI,能精准听懂中文指令、渲染复杂UI,在Arena榜单登顶,解决了多语言、风格等痛点。

新智元
产品应用8

Claude Opus 4.7发布:更严谨的长任务处理与自我验证能力

Anthropic发布Claude Opus 4.7模型,相比4.6版处理长任务更严谨,能自我验证输出。它在视觉、指令遵循、记忆等能力上提升,企业级应用表现出色,还有新功能与安全特性,不过使用成本更高。

AI工程化
新闻资讯8

数据限制具身?觅蜂杀进场破局:高质量数据水电一样即取即用

2026年4月16日,觅蜂科技发布一站式物理AI数据服务平台等,董事长姚卯青称当前具身智能面临数据荒漠问题。觅蜂打造“又全又好又快”数据供给,还启动蜂巢数据共创行动,与多家企业合作。

机器之心
产品应用7

Routa 桌面版发布:内建 Harness 工程的 AI Coding 研发协作工作台

Routa桌面版发布,它是内建Harness工程的AI Coding研发协作工作台。围绕Routa构建Harness工程框架,Kanban成为任务协议,多Agent沿泳道接力协作,重新定义了‘done’,让AI Coding进入协作与交付问题域。

phodal
算法论文8

CVPR 2026|AI开始会拍电影了:一分钟十镜头,全程不崩剧情

多镜头视频生成要求模型处理不同镜头间稳定信息和变化信息,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,建立跨镜头记忆机制,设计关键模块,实验表现好,为视频生成打开新可能。

机器之心
算法论文8

让大模型异步地增强推理能力

在大模型推理时代,Test - Time Scaling成提升能力重要方向,但面临效率问题。ATTS提出异步框架,加入共形预测筛选候选路径,实验显示其加速显著,将测试时扩展推进到‘有原则加速’阶段。

深度学习自然语言处理