「模块化生成策略」共找到 1132 篇相关文章
模型砍掉一大半,准确率反升15%!华科&阿里安全新研究实现ViT近乎无损的类特定压缩|ICLR'26
华中科技大学联合阿里安全部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为大模型服务小场景提供新路径,论文已被ICLR 2026接收。
Context Mode:为你的AI开发工具节省98%的上下文token
开发者分享开源项目Context Mode,它在Claude Code和工具输出间加中间层,采用沙箱隔离和精准检索策略,能节省98%上下文空间,与Cloudflare Code Mode互补,可提升AI从业者工作效率。
首篇以第一性原理剖析OpenClaw自进化AI社会的论文
截止发文,OpenClaw项目已达192k Star,其衍生的AI Agents社会网络moltbook聚集大量智能体。北邮等团队首次从第一性原理研究,提出“自进化不可能三角”理论,还给出缓解策略。
硬核拆解 OpenClaw:如何构建真正稳健的生产级 Agent 系统?【下】
本文延续上篇,继续拆解 OpenClaw 中 Agent 模块工程方法,涵盖安全与风险防御、记忆与状态管理、成本与效能优化、子 Agent 协作机制,介绍其方法并解读,指出企业场景需做取舍。
Attention真的可靠吗?上海大学联合南开大学揭示多模态模型中一个被忽视的重要偏置问题
上海大学曾丹团队联合南开揭示Vision - Language Models中普遍的attention偏置问题,提出无需重训的去偏方法,在多模型、策略及基准上验证有效性,为多模态模型部署提供新思路。
中国团队一夜封神,AI出海「全球第一」!曾靠游戏狂赚10亿美金
在大模型竞争激烈的当下,中国出海团队SeaArt(海艺)用2.5年超越Midjourney等,成全球访问量第一的AI内容创作社区。它打造AI原生内容生态,SeaVerse开启全模态时代,还靠洞察用户、游戏基因等优势制胜。
人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练
人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。
Patreon 年度回顾中的架构经验
2025年Patreon工程团队在为超千万付费会员推新功能时重建底层设施。其年度回顾详述12个项目,提炼韧性迁移、数据模型重构、分布式系统一致性权衡三大架构主题,还分享多项目实操经验。
VLNVerse“宇宙降临”:吴琦团队交出2025具身导航最终答卷
自2018年吴琦团队发表首篇VLN论文后,领域碎片化问题凸显。2025年末其推出全栈平台VLNVerse,涵盖场景生成、物理模拟、任务基准和通用模型,欲打通Real2Sim2Real,推动VLN向Embodied VLN跨越。
小米MiMo-V2-Flash开源:3090亿参数大模型能否改写AI行业规则!
2025年12月16日小米开源旗舰大模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。