MiMo-V2-Flash」共找到 170 篇相关文章

开源动态8

神秘「牛来」模型果然是智谱!GLM首个原生多模态,还用的国产卡

神秘模型「牛来」真身曝光,是智谱刚开源的 GLM - 5.3 Flash,为 5 系列首个原生多模态模型。它尺寸小能力强、价格低,用国产卡,实测多模态和 Coding 能力出色,架构全新,开源后将模型、算力和生态结合。

量子位
开源动态8

不止于快!美团新推理模型正在重新定义「实用主义AI」

美团发布并开源推理模型 LongCat-Flash-Thinking,它在权威测评表现突出。该模型有多项创新,能更快、更能干、更可靠。其将技术实力转化为业务服务能力,实战测试表现佳,体现美团实用主义 AI 路径。

InfoQ
开源动态8

里程碑时刻!首个100B扩散语言模型来了,技术报告揭秘背后细节

蚂蚁集团与高校联合团队推出 LLaDA2.0 系列扩散语言模型,其中 LLaDA2.0 - flash 参数量达 100B。技术报告披露细节,其解决了 dLLM 做大做强难题,性能比肩 AR 模型,为扩散模型工业化带来转机。

机器之心
新闻资讯8

Gemini 3.0 Pro内测流出,编程实力惊人!下周上线

十月AI战场热闹非凡,Sora 2刚亮相,谷歌下一代Gemini旗舰模型Gemini 3.0蓄势待发,最晚下周上线。内部代码流出其有Pro和Flash两版本,实测在编程等方面表现惊艳,虽未发布却暗示编码时代将变。

新智元
开源动态8

万亿思考模型新速度!蚂蚁开源Ring-2.5-1T:IMO金牌水平,强;混合线性架构,快!

蚂蚁集团发布全球首个开源混合线性架构万亿参数模型Ring - 2.5 - 1T,打破深度思考牺牲推理速度和显存的‘不可能三角’。还同期发布扩散语言模型LLaDA2.1和全模态大模型Ming - flash - omni - 2.0,想做成可复用底座。

量子位
新闻资讯8

AI圈“集体开大”!DeepSeek、Claude带头,智谱、阿里、蚂蚁、智源都“卷”起来了

双节前最后一天,AI圈“卷”疯了!智谱发布并开源GLM - 4.6,是国内最强Coding模型;阿里介绍视、听、说全模态同传大模型Qwen3 - LiveTranslate - Flash;蚂蚁开源万亿参数推理大模型Ring - 1T - preview;智源开源跨本体基座大模型RoboBrain - X0。

AI科技大本营
产品应用7

Nano banana手办玩法火爆出圈!无需抽卡,效果惊了(°o°)

小某书被AI手办图刷屏,原来是谷歌的nano - banana(Gemini 2.5 Flash Image)模型爆火。文章实测其手办玩法,还介绍多种玩法,团队透露以文本渲染评估、原生多模态等核心技术,谷歌未来想整合模态实现AGI,还将举办黑客松。

量子位
产品应用7

西游取经团再出征:小米 Token Plan 能把 Token 价格打下来吗?

4月3日小米发布首款“走字儿”Token Plan计费方案,以Credit换算Token,不同模型换算比例不同,取消使用时间限制。实测MiMo V2 Pro完成任务水平在线,成本约为Lite套餐60%,但Token消耗难预估,其价值取决于任务场景。

AI科技评论
新闻资讯7

利润腰斩也要卷AI!小米模型永久降价99%,雷军还要再砸600亿

今日小米宣布 MiMo-V2.5 系列 API 永久降价,最高降 99%,Token 额度提升。虽 2026 年 Q1 财报显示利润腰斩、营收下滑,雷军仍称今年 AI 投 160 亿,未来三年投 600 亿。此前 DeepSeek 也已降价,中国大模型在 OpenRouter 表现亮眼。

AI前线
开源动态7

不可思议!400B大模型在iPhone上跑起来了

一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 大模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上大模型交互级速度运行。

机器之心