「长时稳定性」共找到 1301 篇相关文章
如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性
文章分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在 AI 训练中表现。在满足 GPU 利用率阈值下,能支撑更多 GPU 的存储系统扩展性与稳定性更强,还需关注资源利用率。以太网存储方案灵活且成本效益高。
The Batch: 881 | 一千万 token 的输入上下文
Google的Ali Behrouz等人设计“记忆模块”集成到类transformer架构ATLAS,能处理一千万token输入。它替代注意力层,训练后在长上下文任务中表现佳,但小模型,大规模表现未知。
微软的prompt压缩方案-LLMLingua,开源
使用大语言模型时,提示信息长会致运行慢、费用高、易超限。微软推出的LLMLingua可压缩提示信息,有完整开源。它历经多版本演进,还能用于安全防御,使用简单,值得开发者跟踪。
提速30倍,Meta重新定义了新一代RAG!
LLM时代,RAG成知识密集型任务标准范式,但处理长上下文时面临延迟高、内存贵问题。Meta超级智能Lab针对RAG特殊结构优化,提出REFRAG框架,有独特训练策略,实验效果显著。
刚刚,NeurIPS退让了
AI顶会NeurIPS发布长推文,就编制2026手册时错误加入美国政府制裁工具链接一事解释、道歉并承诺。但网友不买账,中国科协也停止受理参会资助申请,学术社区信任受损难弥合。
跟这个音乐Agent聊会儿,分分钟生成抖音神曲 | 对话音乐创作Agent产品Tunee
量子位智库对话国内首个音乐创作Agent产品Tunee负责人贾朔,探讨了产品适配用户群体、核心交互形式、解决需求模糊性等问题,还提及产品价值、迭代方向及推出智能硬件的原因。
贴脸对打Opus 4.5!最新Codex自己写自己,网友实测“放手”8小时不崩
Claude Opus 4.6发布不到半小时,OpenAI就上线GPT - 5.3 - Codex,这是其最强的Agent化编程模型。它多项跑分超Claude Opus 4.6,网友实测长链路稳定性好,虽慢但稳。OpenAI总裁称Agent正重构软件开发。
独家对话 Looki 创始人孙洋:摸着自己过河
本文是对Looki创始人孙洋的独家专访。Looki L1发布后意外大火,但前期市场策略保守,未突出AI。用户使用时长超预期,产品隐私设计消除担忧。团队在供货、软件迭代等方面不断探索,商业模式也在摸索中。
微软正式发布 Agent Framework Harness 和 Hosted Agents
2026年4月2日微软发布Agent Framework 1.0版本,Build 2026大会上相关组件进入稳定发布阶段,后Harness和Foundry Hosted Agents正式发布,解决构建和运行时问题,还介绍其功能、优势等。
ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE
长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。