「MoE模块」共找到 381 篇相关文章
4个文件,1个超级目标,我用Trae搭建了一个不会"失忆"的AI分身,还免费
AI产品黄叔分享用字节AI IDE Trae搭建AI分身的经验。他指出原用的Monica有价格高、记忆受限等局限,新系统含个人档案等四模块,由智能体串起,能自动同步,体验更好,还适合PDCA循环助力自我提升。
2025 年最全面的 LLM 架构技术解析【长文】
Sebastian Raschka更新「大型LLM架构对比」长文,解析2025年LLM架构发展。介绍了如DeepSeek V3、OLMo 2、Gemma 3等模型架构特点,像DeepSeek V3用MLA和MoE提升效率,还探讨线性注意力复兴等趋势。
GitHub上已突破5.1k stars!这是真正被开发者认可的 AI Agent平台,AI开发者必看,如何用它实现生产力逆袭?
TaskingAI是AI - native应用开发平台,整合多模块提供一站式BaaS体验,简化AI应用全流程。它支持多模型,有检索、工具插件等功能,适用于客服、销售等场景,还对比同类项目展现优势。
AI实践|基于 Spring AI 从0到1构建 AI Agent
本文是基于Spring AI构建AI Agent的实践分享。该项目集成RAG、Function Calling等核心能力。文章从六个核心模块剖析其架构与实现,涵盖配置、访问方式,还介绍各模块工作机制、代码及应用场景。
智能体工程的隐形技术债:10分钟造出一个 Agent,公司却要为它养一个平台团队
如今构建智能体容易,但投入生产后会面临诸多问题。文章围绕智能体绘制出集成、上下文湖等七个基础设施模块,分析各模块隐性技术债务,并指出不同阶段债务表现,还提及应对措施及相关会议推荐。
万亿参数狂欢!一文刷爆2025年七大顶流大模型架构
文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。
【博客翻译】使用PyTorch加速生成式AI第四部分:Seamless M4T,快速优化
这是使用纯原生PyTorch加速生成式AI模型系列博客的第四部分,专注加速FAIR的Seamless M4T - v2模型。通过torch.compile + CUDA Graph,在不损失精度下实现text decoder模块2倍、vocoder模块30倍加速,端到端推理2.7倍加速。
GoPro卖身了,准备搞光模块
当地时间9月1日,GoPro与Starman Optical达成合并协议,后者2.85亿美元收购约90%股权。GoPro曾辉煌,后因产品、对手、内存等问题衰败。Starman看中专利等,GoPro或涉足新领域。
暴涨3倍!光模块背后大赢家
2025年源杰科技股价表现强劲,年初迄今涨幅达348%,反超下游大客户中际旭创。其前三季度业绩爆发,得益于数据中心市场产品放量。随着AI算力需求爆发,光互连技术向CPO架构演进,对光芯片要求提高,源杰科技高端产品突破助其获利。
国民技术:覆盖机器人多模块,提供MCU+安全+蓝牙全栈芯片解决方案
国民技术是MCU及安全芯片领先企业,其N32H7/4系列MCU为荣耀“元气仔”、越疆Rover X1等机器人提供关键支撑,还广泛应用于工业机器人。此外,公司构建了MCU + 安全 + 无线射频的完整产品矩阵。