「大模型记忆系统」共找到 9030 篇相关文章
我去,还能这么玩?AI新宠DocExt:纯本地文档抽取,开源免费还无依赖!你还在为OCR头疼吗?
DocExt 是 Nanonets 开源项目,为全流程无 OCR、零云依赖的本地文档结构化提取工具,适用于多种文档类型,支持字段与表格识别。它零 OCR 误差小、可本地部署,还能灵活接入模型。
Meta Shuffling的MoE Grouped GEMM kernel benchmark
作者拷贝fbgemm开源的moe grouped gemm kernel,修复小bug后与SGLang的Grouped GEMM Triton Kernel对比,结果显示fbgemm在MoE模型上性能提升显著,可应用到SGLang的ep - moe的grouped gemm kernel中。
Nature子刊 Scientific Data | 九家单位联合打造!AeroFlowData
现有湍流数据库多聚焦中低雷诺数基础湍流问题,难应对复杂工程高雷诺数湍流挑战。西北工业大学联合八家机构建全球共享的高雷诺数湍流数据库AeroFlowData,结合多技术获取数据,收录近40类模型、超500种工况,数据近100TB。
开源「活人感写作.skill」,只为帮你写出没有AI味的文字。
作者开源活人感写作.skill,旨在帮大家写出无AI味文字。它适配多种模型和产品,鼓励用真实经历创作,除了去除辞章端AI口癖,还会激发思想、验证事实,让大家保留自我。
DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开
路透社消息,凭借算法震动硅谷的中国AI公司DeepSeek正秘密开发自研AI芯片,定位推理,项目约一年前启动,现处早期。全球模型公司自研芯片成趋势,虽挑战大,但DeepSeek有资金支撑。
Marvis 实测:6 个 AI“牛马”扎根桌面之后
作者实测腾讯 Marvis,它能实现终端调度、多 Agent 协同、跨模态任务链执行等。虽在编码、审美等方面有不足,但定位安全实用,适合普通用户,体现 AI 助手从对话工具向执行系统转变。
我用 Moxt,开了一家 AI 公司
作者体验 Moxt 后,用其创建 AI 团队做炒股分析、开发产品、设计桌游。Moxt 是 AI 原生协作平台,AI 同事有持久记忆,Workspace 灵活。个人和团队用它能提升效率,实现与 AI 深度共事。
10小时连崩4次、Claude疯狂宕机!刚把ChatGPT干到295%卸载量,就没顶住二次“爆红”?
昨日,Anthropic旗下Claude及Claude Code服务中断,10小时内连崩4次。此前特朗普下令停用Claude,但其用户量激增,还让ChatGPT卸载量暴涨295%,Anthropic还升级Claude记忆功能降低迁移门槛。
这一年,DeepSeek消耗14万亿Token,编程仅占1/10,超一半用于角色扮演?
a16z和OpenRouter基于100万亿token研究揭示LLM使用情况:开源模型占三成市场,编程任务成刚需,角色扮演是金矿。还提到‘玻璃鞋效应’影响用户留存,市场分层为‘高端闭源+性价比开源’双轨制。
我写 nano banana pro 提示词时的原则和策略
作者分享写 nano banana pro 提示词的原则与策略,原则是做成模板、结合模型能力;策略是先跑通原型再抽象成模板;不过度精简提示词,还介绍用 GPT-5.1 等工具辅助。