记忆增强型大语言模型」共找到 1920 篇相关文章

新闻资讯7

Cloudflare 年度回顾:AI 机器人疯狂爬网、后量子加密普及率达 50%、Go 语言用户翻倍

近日,Cloudflare发布第六版Radar年度回顾报告。显示全球互联网流量增长19%,Googlebot爬取引流比攀升,后量子加密普及,Go语言客户端发起API请求占比近翻倍,还提及各类网络技术及事件情况。

InfoQ
开源动态8

5.2K Star!离线也能翻译,零网络高隐私,40+语言的纯本地翻译神器!

日常在线翻译服务有隐私、离线使用等问题,Argos Translate是100%本地运行的离线翻译方案,免费、隐私安全,支持40多种语言,具备多模态接口、GPU加速等功能,适合多种场景。

开源星探
开源动态8

AI 本地跑?Google 新开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言

Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。

InfoQ
算法论文8

视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26

多镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为多镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。

量子位
开源动态8

AI编程节省95% token,工具调用上限狂飙20倍,开源记忆系统登顶GitHub热榜

Claude - Mem是一款登顶GitHub热榜的持久化记忆系统,直击AI编程助手跨会话失忆痛点。它免费且省token,通过‘三层渐进式披露’架构,常规省90%,测试阶段省95%,工具调用上限提20倍。

量子位
新闻资讯7

语言模型内部还藏着众多策略模型?自底向上强化学习重塑底层特征 | 直播预约

现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出自底向上强化学习策略,为研究架起新桥梁。

深度学习自然语言处理
新闻资讯8

TypeScript 之父 Anders Hejlsberg:别折腾“AI新语言”了,真正变天是 IDE 让位给 Agent

TypeScript 之父 Anders Hejlsberg 在与 GitHub 研究顾问对谈中回应质疑,称选 Go 重写编译器合理。他认为 AI 编程时代,TypeScript 语言服务将重塑,IDE 或让位给 Agent,还谈到 AI 在代码迁移中的应用及开源可持续性问题。

InfoQ
算法论文8

复旦、同济和港中文等重磅发布:强化学习在大语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结大语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三大贡献。

机器之心
新闻资讯8

图灵奖得主Hinton国内首次现身演讲:AI超越人类后,我们该怎么做

在世界人工智能大会WAIC上,图灵奖得主杰弗里・辛顿发表演讲,围绕AI历史、未来等展开。他认为大语言模型与人类理解语言方式相似,数字智能知识分享效率远超人类,还提议构建网络让AI向善。

机器之心
新闻资讯8

AI教父辛顿上海WAIC主题演讲:LLM真的理解语言,数字智能极其危险,可以无限复制

AI教父杰弗里·辛顿在WAIC开幕式演讲,对AI发展警惕且悲观。他认为LLM真理解语言,数字智能与生物智能差异大,AI进化快很危险,人类应全球合作研究让AI向善。

AI寒武纪