运行时」共找到 1163 篇相关文章

算法论文8

突破Agent长程推理效率瓶颈!MIT&新加坡国立联合推出强化学习新训练方法

AI Agent处理复杂任务显存、算力问题凸显,MIT和新加坡国立大学联合提出MEM1框架。它基于强化学习,让智能体学会管理记忆,实现近似常量级显存开销,在多方面表现超越大模型。

量子位
推荐文章7

我的空白页恐惧症,被AI治好了

作者分享摆脱空白文档恐惧的经验,认为可让AI先写初稿,人与AI协同创作。以百度文库Genflow 2.0为例,展示其在资料导入、任务执行等方面优势,鼓励大家尝试与AI协作。

花叔
算法论文8

自我进化Agent综述:通往超级智能的进化之路

当前大型语言模型面对新知识、动态环境存在固定参数瓶颈,自进化智能体研究应运而生。本论文作为该领域首部系统性综述,提出革命性框架,解析自进化智能体技术脉络与未来挑战。

深度学习自然语言处理
产品应用8

腾讯 CodeBuddy IDE 如何成为一个“全栈高级工程师”?

腾讯 CodeBuddy IDE 海外版开启内测,国内版预计 8 月上线。它定位‘下一代 AI 全栈高级工程师’,内置 4 个智能体,助力全链路研发。腾讯内部超 43% 代码由 AI 生成,编码长缩短 40%。

AI前线
新闻资讯8

77岁Hinton首度访华,周伯文高能交锋!17分钟尖峰对话震撼全场

7月26日,77岁的AI教父Hinton首度访华,与周伯文教授进行17分钟尖峰对话。Hinton称多模态大模型已有「意识」,建议分技术训练「聪明」与「善良」AI,两人还探讨AI发展路径并寄语青年科研者。

新智元
产品应用7

好奇心之旅:Cursor代码库索引机制的学习笔记

作者作为高德信息工程团队AI先锋队一员,日常用Cursor开发,因好奇其代码库索引机制展开探索。介绍了Cursor索引工作流程、隐私安全等,还研究Merkle树、turbopuffer向量库及开源方案Continue。

阿里云开发者
产品应用7

vLLM 技巧: 在几秒钟内无需重启释放90%的 GPU 显存

EmbeddedLLM介绍vLLM新功能“休眠模式”,可在不重启服务几秒内释放约90% GPU显存,实现模型热插拔与高效轮转,还介绍使用方法、不同休眠级别,提醒生产环境要确保安全。

AI工程化
开源动态8

阿里深夜开源王炸Agent!硬刚OpenAI,性能全面SOTA!

过去半年,开源Agent在解决复杂难题难敌OpenAI。昨天阿里通义开源WebSailor模型,用完整可复现方法论挑战闭源霸权,通过构造L3合成数据、取精华训练轨迹、两步走训练策略提升性能。

PaperAgent
算法论文8

用子模优化法为DeepResearch生成多样性查询

开发DeepResearch,生成多样化查询是关键。多数开源项目处理方法粗放,本文提出结合句向量与子模优化的方法,设计子模目标函数,给出代码实现,实验显示该方法生成的查询组合多样性更高。

Jina AI
8

重磅发现!大模型的「aha moment」不是装腔作势,内部信息量暴增数倍!

中国人民大学等联合团队研究发现,大模型推理有“信息脉冲”,特定步骤互信息值飙升形成“互信息峰值”,对应“思考词汇”。基于此提出无需额外训练提升推理性能的方法,代码已开源。

机器之心