部署时学习」共找到 2574 篇相关文章

产品应用8

OneSearch,揭开快手电商搜索「一步到位」的秘技

本文介绍快手提出的电商搜索端到端生成式框架 OneSearch。它有三大创新,包括 KHQE 模块、用户行为序列注入策略、偏好感知奖励系统。实验显示它在多方面提升显著,已部署于快手电商搜索场景。

机器之心
算法论文8

吴恩达新作:87%推理token用不着,丢掉反而快3倍

吴恩达新作Prefix Sliding指出,模型推理丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。

PaperAgent
推荐文章8

专访火思动力Kevin Ding:未来选择Agent,要看它过去三十天学会了什么|甲子光年

本文是对火思动力创始人Kevin Ding的专访。他指出当下Agent会工作但不会成长,而如今市场需求、技术条件和数据供给成熟,可开展持续学习。他还阐述了后训练、产品应用、商业化等方面观点。

甲子光年
推荐文章8

转载 | 鄂维南院士:关于推动AI从工程化走向科学化的一点思考

鄂维南院士探讨推动AI从工程化走向科学化。回顾AI先驱,指出基础理论滞后致发展起伏、大模型开发依赖经验。介绍AI主要方法,分析深度学习基础理论问题,强调从系统角度看待AI,认为已到科学化转折点。

力学与人工智能
科研成果8

这个情人节,AI深吻Math!国产RL系统多维突破300年亲吻数难题

2月14日情人节,上智院等联合研发的PackingStar强化学习系统,在多维度刷新亲吻数与广义亲吻数纪录,实现数学结构领域多维度、系统性突破。它将复杂几何问题转化为可训练游戏,成果获权威认可。

机器之心
推荐文章7

用AI深读100本书,太上头了~

国外开发者Pieter让Claude深读100本非虚构类书籍,用AI‘深化’阅读。AI能在书间找联系,还生成奇葩分类并挖出洞见。实验带来三个启发,还给出低成本复制思路,强调学习要让知识建立连接。

CourseAI
开源动态8

AI记忆革命爆发!Clawdbot如何像大脑般记住一切

2026年初开源个人AI助手Clawdbot引爆社区。它可本地运行、集成聊天平台、自主处理任务,有长记忆和任务执行能力。AI研究工程师Manthan Gupta复盘其记忆机制原理,涉及上下文、记忆存储、搜索等内容。

新智元
算法论文8

LLM记忆管理终于不用“手把手教”了,新框架让智能体自主管理记忆系统

加州大学圣地亚哥分校和斯坦福大学研究人员提出强化学习框架Mem-α,用于训练LLM智能体自主管理记忆系统。它将记忆构建转为序列决策问题,采用多维度奖励函数,实验显示其全面超越现有方法。

量子位
算法论文8

一篇Self-Evolving Coding Agents最新综述

当今编码智能体部署后大多静止,自进化编码智能体应运而生,可让Agent通过交互更新自身。文章介绍了其概念、分类,探讨组件进化机制、机及评估方法,也提及带来的新挑战。

PaperAgent
新闻资讯7

“小龙虾”太多了,CPU告急

当地间4月9日,谷歌与英特尔宣布扩大多年期合作,部署至强处理器并联合研发IPU。当前AI基础设施瓶颈从GPU向CPU迁移,CPU需求激增但供应紧张,引发产业链连锁反应,其价值重估受多因素影响。

芯师爷