长期记忆基准」共找到 1564 篇相关文章

产品应用7

AIGCode宿文:我就是要自训练大模型,直接做「L5」| AI产品十人谈

AIGCode宿文坚信Coding是培育大模型的最佳场景,公司自训练66B基础模型,发布锡月大模型,开启AutoCoder内测。宿文认为AI Coding能解决代码供给问题,目标是实现AGI,虽面临诸多质疑,但他坚持直接做L5。

AI科技评论
算法论文8

EMNLP 2026高分论文MathDebugger:当合成数据涌入训练集,如何为数学题做体检?

随着合成数据增多,模型需判断数学数据题目能否被信任。北大DCAI团队提出MathDebugger质检BenchMark,覆盖问答两端,评测主流LLM和PRM。还探究能否判断正误、分类错误、修复数据,证明错误标签可作监督信号。

InfoQ
推荐文章7

个体如何实现主权AI

文章指出越依赖AI,越要考虑‘主权AI’问题。对个体而言,实现主权AI核心是掌握自身数据等,能随时换底层模型,还介绍积累的四类资产、微调顺序及现实路径。

newtype AI
新闻资讯8

矩阵起源(MatrixOrigin)完成超千万美元A轮融资 | 5Y News

2026年8月6日,企业级AI基础设施厂商矩阵起源完成超千万美元A轮融资,由汉得信息参与投资的基金、亚康股份与Artesian Venture Partners注资。资金用于平台研发、市场拓展等。其产品具优势,获多方认可。

五源资本 5Y Capital
开源动态8

微软 SkillOpt:不动模型权重,只训练那份「技能说明书」

微软研究院 Yifan Yang 等人推出 SkillOpt,思路反直觉,不动模型权重,把「技能文档」当可训练参数。它在 52 个组合中表现最优,技能可迁移,代码已开源,还支持多操作。

AI工程化
新闻资讯8

Anthropic首次揭秘下一代Claude怎么造!用户吐槽直接喂模型,连AI“做梦”都被训练

Anthropic研究团队产品经理Alex在访谈中透露Claude演进方向,如将模型开发产品化、向“持续运行Agent”演化,还解释“dreaming”机制等,也提及训练“人格”、研究意识等,展现了长远思考。

InfoQ
算法论文7

Transformer与RNN合体,谷歌打下显存门槛,解锁超长上下文

谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。

机器之心
算法论文8

CVPR Highlight|让无人机学会自己认路+锁位目标,国防科大给出一套新解法

国防科技大学 SAW Lab 团队联合多高校推出无人机实时地理定位系统「PiLoT」,首次仅靠单目 RGB 序列在 GNSS 拒止环境完成无人机及目标定位,性能达先进水平,成果被 CVPR 2026 接收。

机器之心
新闻资讯8

YC 专访 OpenClaw 创始人:80% 的 App 将会消失,我们还剩下什么?

YC 深度访谈 OpenClaw 创始人 Peter Steinberger。他本是半退休开发者,因 AI 智能体 Moltı 爆火。他认为 AI 应回硬盘,OpenClaw 能控制设备、处理文件。还谈到机器人雇佣人类、80% App 将消失等观点。

AI科技大本营
推荐文章8

AI Agent 总翻车?这篇综述戳破了 3 个关键误区

很多团队做AI Agent停留在‘LLM+工具’表面拼接,运行易出问题。该综述指出AI Agent是‘系统’,介绍其架构,还给出常见误区的应对方法、落地检查清单,展望应用前景。

CourseAI