「MoE层」共找到 452 篇相关文章
a16z:2026 年的 AI 应用生态,关键问题是这几个
a16z投资人Anish Acharya探讨2026年AI应用生态关键问题。他指出应用和模型分化将更明显,未来AI应用是组合体。还提到工具本质会变,企业部门要软件优先,应用层创业公司有多种优势。
专为小说、角色扮演等而生:元象开源泛娱乐场景底座模型
元象作为AI与3D技术服务公司,此次开源XVERSE-Ent系列中英双语大模型。它采用MoE热启动技术与三阶段训练策略,解决泛娱乐场景痛点,适配多元语境,有高部署性价比,为行业提供泛娱乐AI解决方案。
美团也开源了大模型,但我觉得他们的野心是通用生活Agent。
美团发布并开源560B参数的MoE模型LongCat - Flash - Chat,推理速度快。与DeepSeek V3对比,输出速度优势明显。美团多个落地或内测AI功能服务C端生活场景,目标是打造通用生活Agent。
SGLang 优化Triton FusedMoE 的一个新技巧
蚂蚁在SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,在DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。
吴恩达YC演讲:AI创业如何快人一步?
吴恩达在YC演讲为AI创业者建议,强调执行速度是衡量创业公司成功的重要指标。他探讨AI技术加速工程和产品反馈等,还谈及AI创业机会在应用层,给出提升创业公司速度的方法等。
Gartner发布生成式AI模型提供商魔力象限
Gartner发布《生成式AI模型提供商创新指南》,首次对生成式AI市场进行象限划分,按功能完整性和未来潜力将厂商分为新兴领导者、新兴挑战者、新兴远见者和新兴专家四个区域,还指出AI正从实验转向企业核心层。
Agent = LLM + Memory + Planning + Tool Use
文章指出LLM设计无状态,产生幻觉,超长上下文窗口也无法解决记忆问题。介绍人类记忆的三个系统,阐述Agent记忆四层演化及每层问题,推荐开源项目Cognee将向量、图、关系型结合互补。
Claude自己写出Claude!2小时干完两月活,人类在工位上多余了?
Anthropic推出的AI办公利器Claude Cowork引发关注。它能两小时干完两个月的工作,代码由Claude Code自己编写。该工具应用广泛,让人类面临职业价值拷问,也可能成为今年AI应用层趋势。
AI 原生初创公司,都把钱花在了哪些 AI 产品上?
a16z与Mercury合作调研,基于超20万客户数据库,分析2025年6 - 8月支出模式,筛选出50家AI应用层公司。榜单揭示AI在产品与工作流的落地情况,显示早期创业公司愿买单的AI应用方向。
Thinking Machines新发现:Lora不是权宜之计,哪怕秩低到 1,也能匹敌全参数微调
Thinking Machines和John Schulman新研究刷新对LoRA的认知,实验显示正确使用时它能匹敌全量微调。团队系统研究训练集与参数关系,有层选择、学习率等关键发现,还给出实用建议,但LoRA在部分场景表现待验证。