「分层缓存架构」共找到 2022 篇相关文章
原生理解生成统一:商汤开源SenseNova U1,用统一架构终结「缝合怪」多模态
商汤开源日日新 SenseNova U1 系列原生理解生成统一模型,采用 NEO-unify 架构,只需 8B 小参数就能实现很多商业闭源模型效果。在多测评维度性能领先,还能实现连续性图文创作输出,解决理解与生成断层问题。
腾讯AI战略大升级:组织架构重组与混元世界模型1.5发布
2025年12月17日,腾讯宣布两项重大举措,一是重组AI组织架构,成立新部门并任命首席AI科学家;二是发布混元世界模型1.5,能实时生成可交互3D虚拟世界,应用场景广泛,或引领行业进入‘AI原生’新阶段。
24条小红书流量方法,AI使用者分层,各平台账号解封技巧等,【收藏】
这篇综合文包含6篇合集,涵盖小红书流量增长心法、AI使用者分层、平台账号解封技巧、创业者项目放大方法、烘焙店盈利策略及执行力探讨等内容,对搞流量、创业及用AI有启发。
ICML 2025 | 打破残差连接瓶颈,彩云科技&北邮提出MUDDFormer架构让Transformer再进化!
彩云科技与北邮联合提出多路动态稠密连接(MUDD)替代残差连接,提升Transformer跨层信息传递效率。实验显示,采用该架构的模型性能显著提升,论文等均已公开。
SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的多精度气动融合方法
高可靠性气动数据降本增效是关键命题。本研究总结主流多精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。
视觉思维链全新架构,加州大学让多模态大模型有了灵性,整体性能提升5.3%
加州大学伯克利分校等团队提出视觉思维链(CoVT)架构,让视觉语言模型推理时生成连续视觉信号。它内化轻量级专家能力,采用对齐策略和四阶段训练,实验显示性能提升,还具可解释性。
AI生图大洗牌!流匹配架构颠覆传统,一个模型同时接受文本和图像输入
AI生图有新突破,新模型FLUX.1 Kontext用流匹配架构,与此前技术不同,能接受文本和图像输入。其来自Black Forest Labs,有编辑和生成能力,还具备4个特性,第三方测试也给出提示词使用技巧。
即将开源 | 阿里云Tair KVCache Manager:企业级全局 KVCache 管理服务的架构设计与实现
阿里云Tair KVCache团队联合多团队将开源Tair KVCache Manager,介绍其架构设计与实现。该服务应对Agentic AI下KVCache存储挑战,解决传统模式难题,具备企业级管理能力,后续还会完善多方面功能。
给企业应用注入AI:架构师需关注的3大工程挑战与9种设计模式
文章指出企业常将AI引入现有应用,集成时要考虑系统风险。介绍架构师需关注的3大工程挑战及9种设计模式,含可用性、性能、安全增强相关模式,助企业让AI应用从“能用”变“好用”。
为什么你的 Agent 总是出故障?从算力基建到可信熔断的架构生死线 | 直播预告
本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 的构建之道。将探讨大模型基础设施、可信 Agent 架构、MCP 协议实战等内容,还会解答观众提问。