保存记忆系统」共找到 2080 篇相关文章

推荐文章8

Kimi 大模型训推混部的稳定性与资源优化实战

月之暗面系统工程师黄维啸在 QCon 大会分享 Kimi 大模型训推混部实践。介绍了训推集群挑战,如故障多、资源利用低等,还阐述了全链路稳定性提升、资源高效利用及强化学习混合部署等方案。

InfoQ
新闻资讯7

Grok火爆全球,靠的居然是一个二次元金发美少女。

马斯克推出Grok的companion功能,3D虚拟人Ani是二次元金发美少女。功能上线后Grok热度大增,下载量在日本和中国香港冲到第一。Ani有好感度系统,能换衣服,还可聊NSFW内容,引发用户兴趣。

数字生命卡兹克
推荐文章7

大模型最难的AI Infra,用Vibe Coding搞定

Andrej Karpathy 力荐的 Vibe Coding 在 AI Infra 开发中常「水土不服」,存在上下文丢失、决策偏离、质量不稳定等问题。文章提出文本驱动的 Vibe Coding 方法,并以 Agentic RL 中的资源调度系统为例验证其有效性,还介绍了相关团队和工具。

机器之心
新闻资讯7

ICCV 2025放榜!录取率24%,夏威夷门票你抢到了吗?

ICCV 2025 于 10 月 19 - 25 日在美国夏威夷举行,已公布论文接收结果,录用率 24%。投稿量近 2019 年三倍,录用率较稳定。会议实施新政策,部分论文因审稿人问题被拒引争议。还提及投稿量激增挑战及评审系统改革建议。

机器之心
开源动态8

一年从3B卷到0.xB:MonkeyOCRv2用0.7B拿下17语种文档解析开源第一

文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移到多任务表现良好。

量子位
算法论文8

大语言模型离“数学证明高手”还有多远?斯坦福、伯克利、MIT 团队提出 IneqMath 评测标准

现在很多大语言模型常给出看似正确的结论,但推理过程却有问题。斯坦福、伯克利和MIT团队提出新思路,构建IneqMath数据集及‘AI数学裁判系统’,研究发现很多模型推理不严谨,还给出两个提升准确率的办法。

AI前线
产品应用7

OPPO新AI操作系统,走出屏幕“指哪答哪”,嘈杂环境只听你声音

OPPO新一代AIOS ColorOS 16来了,“一键闪记”和“一键问屏”功能有新玩法。“一键闪记”能记取餐码等,还会“记忆共生”;“一键问屏”走出屏幕,嘈杂环境也能只听你声音。此外,OPPO宣布全新AI技术架构。

量子位
推荐文章7

微软副总裁X上「开课」,连更关于RL的一切,LLM从业者必读

微软副总裁 Nando de Freitas 在 X 上「开课」,分享人工智能教育帖子,从 LLM 的强化学习讲起。内容涵盖无监督、监督、强化学习定论,分布式强化学习系统构建,RL 用于后训练 LLM 等,还介绍单步强化学习与策略梯度及相关技巧。

机器之心
算法论文8

Self-Forcing++:让自回归视频生成模型突破 4 分钟时长极限

加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让自回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。

机器之心
算法论文8

工行x上交大发布多智能体研究成果,通过群体智能刷新翻译新高度!

2025年多智能体系统成大模型研发新高地。工行大数据和人工智能实验室与上海交大人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理