「原生统一架构」共找到 2581 篇相关文章
Token洪流的转向:当AI Agent成为Token消耗的主宰,什么样的推理服务基础设施才是刚需
Token消耗量转移,AI Agent成Token消耗主宰,大模型推理服务底层逻辑重塑。文章介绍AI Agent时代范式转变、对推理基础设施的需求,还阐述了为其打造的AI Serving Stack架构及优势,它获2025年度相关卓越奖。
马斯克罕见低头:开源𝕏推荐算法,自嘲“很烂”不过未来月更
马斯克开源𝕏推荐算法系统,这是几乎全由AI模型驱动的系统。它基于Grok - 1同款Transformer架构,通过学习用户历史互动行为推荐内容。虽获社区称赞,但算法有缺陷,马斯克也承认‘很烂’,未来将月更。
SGLang Hierarchical Sparse Attention 技术深度解析
阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了长上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。
这一次,谷歌Veo 3.1教Sora做视频!角色0变形,4K竖屏直接满分
谷歌Veo 3.1迎来重磅升级,优化移动端体验,上传素材图片就能创作有趣视频。亮点包括素材生视频一致性强、支持原生竖屏输出、有业界领先的1080p和4K超分辨率,现已可在多平台体验。
万字长文|迈向电商大模型时代,从虚拟试穿聊到电商AIGC
本文是京东李岩博士在AICon2025的演讲整理。他从虚拟试穿切入,拆解其技术逻辑、行业实践与未来趋势,还介绍京东电商AIGC布局,如商品抠图、素材生成等能力,分享业务成果及对电商AIGC未来的看法。
阿里云 Tair 基于 3FS 工程化落地 KVCache:企业级部署、高可用运维与性能调优实践
本文介绍阿里云 Tair KVCache 团队与服务器研发存储软硬件结合团队对 3FS 的工程化升级实践。从性能、产品、运维维度优化,为高性能 KVCache 在企业级 AI 场景落地提供范式,还提及未来 3FS 产品化及服务器硬件升级方向。
Scaling Law 仍然成立,企业搜广推怎么做才能少踩“坑”?
InfoQ《极客有约》X AICon 直播邀请京东颜林等探讨生成式推荐落地洞察。指出搜广推场景 scaling law 成立且在上升,还分享大模型对搜广推的改变、架构成长方式,及平衡成本等方面的经验。
AI引发K型分化:Gemini 3 加剧技术劳动力分化,判断力为王,基础岗位将被AI完全替代,程序员也不例外
2025年11月Google发布Gemini 3,依托多模态MoE架构和“Deep Think”模式,在软件工程等领域实现推理能力质的飞跃。它使前端开发工作重心转移,重构软件工程工作流,赋能白领但带来隐患,还冲击劳动力市场,提升软件掌握门槛。
BettaFish微舆:一个多智能体舆情分析系统
BettaFish微舆可依自然语言需求抓取分析30多个主流社交媒体生成舆情报告。它将任务拆解给不同智能体,系统架构清晰,最终整合生成带时间线分析的HTML报告。项目在GitHub开源且登顶趋势榜第一。
吴恩达关注的Ling-1T背后,蚂蚁Ling 2.0技术报告解密万亿模型开源配方
AI导师吴恩达关注蚂蚁开源模型Ling-1T,其性能直逼闭源模型。蚂蚁集团通过《Ling 2.0 Technical Report》揭示技术配方,从架构、预训练、后训练对齐和基础设施四个层面构建推理模型,还分享失败教训,提供开源SOP。