超稀疏 MoE」共找到 2281 篇相关文章

开源动态7

无需租GPU,一台24GB内存的笔记本就够了!

阿里开源稀疏 MoE 模型 Qwen3.6-35B-A3B,总参数 35B,激活 3B。它在智能体编程上越前代,可与稠密模型媲美,支持多模态,已在 Qwen Studio 上线,还能集成第三方编程助手。

GitHubStore
算法论文8

40年首次突破!清华大学发布全新最短路径算法,打破理论瓶颈:数据中心有望节省大量计算资源

清华大学Ran Duan、Longhui Yin团队发表论文,提出确定性新算法,在稀疏图上表现经典Dijkstra算法。新算法时间复杂度为`O(m log²/³ n)`,不维护全局有序顶点队列,应用前景广,可节省计算资源。

AI寒武纪
产品应用8

手机跑推理模型:Liquid AI发布仅需900MB内存的LFM2.5-1.2B-Thinking

Liquid AI发布LFM2.5 - 1.2B - Thinking推理模型,仅需900MB内存就能在手机运行。它专为简洁推理训练,性能提升明显,多数性能基准Qwen3 - 1.7B,在多平台表现佳,还支持主流推理框架。

AI工程化
新闻资讯7

马斯克开始用Grok替代员工了!最惨部门裁员90%

据The Information消息,马斯克用Grok取代X员工,负责信任与安全问题的工程团队从100人裁至不足10人。他意图用AI替代人力、自动化替代传统工程,还推进“巨硬计划”,但也带来权责不对等、安全问题和业务受阻等风险。

量子位
新闻资讯7

硅谷GPU蒙尘,马斯克一言成谶:美国AI被电卡脖子

彭博社消息,加州圣克拉拉两处数据中心空置6年多等电力,凸显美国科技行业缺电问题。此前微软纳德拉承认缺电致GPU吃灰,马斯克也曾预言芯片或供电能力。电力短缺制约数据中心发展,影响美国AI前进。

新智元
开源动态8

Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统

Meta发布全新自动语音识别系统Omnilingual ASR,支持1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。

AI工程化
7

蚂蚁投了一家具身智能公司,做手的

具身智能市场火热,灵心巧手完成数亿元天使轮融资,由蚂蚁集团领投。该公司成立于2019年,此前已有亿元种子轮融资。其自研灵巧手技术强、成本低、销量高,应用广泛,未来将聚焦软硬件协同。

量子位
算法论文8

众所周知视频不能P?北大施柏鑫团队、贝式计算CVPR研究:视频里轻松换衣服、加柯基

视频编辑难度高,传统流程繁琐,现有AI方法有局限。北大施柏鑫团队联合贝式计算等提出VIRES方法,能实现视频主体多种编辑操作,还标注VireSet数据集。其在多指标现有SOTA模型,团队还探索全景级可控视频生成。

机器之心
产品应用7

混元 Hy3 发布:99% 的任务,够用了

腾讯混元模型 Hy3 正式上线,免费使用两周。它是快慢思考融合的 MoE 模型,主打 Coding 和 Agent 场景,性价比高。作者用它做了多项测试,如制作 PPT、开发代码、舆情分析等,还与 GLM - 5.1 对决,表现不错。

AGI Hunt
算法论文8

Meta提出Deep Think with Confidence:几乎啥都不用动,就能提升推理的准确性与效率

传统自一致性方法虽能提升推理准确率,但计算开销大、收益递减。Meta AI与UCSD团队提出Deep Think with Confidence(DeepConf),可在不增训练成本和不调参数下,提升推理准确性与效率,本文对其全面解读。

深度学习自然语言处理