Mistral - small3.2」共找到 3476 篇相关文章

开源动态8

【博客翻译】使用PyTorch加速生成式AI第四部分:Seamless M4T,快速优化

这是使用纯原生PyTorch加速生成式AI模型系列博客的第四部分,专注加速FAIR的Seamless M4T - v2模型。通过torch.compile + CUDA Graph,在不损失精度下实现text decoder模块2倍、vocoder模块30倍加速,端到端推理2.7倍加速。

GiantPandaLLM
新闻资讯7

谁家更新日志那么长啊?Claude Code版本更新引围观,1096次提交一口气上线

Claude Code 从 2.0.76 版本更新到 2.1.0,合入 1096 个 commit,更新日志超长引网友调侃。重点更新包括 Shift+Enter 换行、钩子支持等。后续又有 2.1.1 和 2.1.2 版本修复问题,但有开发者不满更新多且 bug 多。

机器之心
算法论文8

通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持

LLM.265研究发现,视频编码器是高效的大模型张量编码器,现成视频编解码硬件压缩AI模型数据效率高。它灵活控制码率、可压缩多种张量,还能利用GPU硬件加速。实验显示其压缩效果显著。

新智元
产品应用8

3 亿美元 ARR、估值超 20 亿美元,演语科技是怎么做 ToC 应用增长的?

AI应用难做,演语科技却完成近3亿美元B+轮融资,估值超20亿美元,ARR超3亿美元。其成功在于找准付费人群、做厚应用、激进增长,让产品功能转化为收入,为AI应用商业化提供范例。

Founder Park
产品应用7

Canva可画联合创始人独家专访:2.65亿用户的Canva,用自研模型,解决了设计的审美问题

Canva月活2.65亿,在a16z排名第三。4月16日开启Canva AI 2.0内测。联合创始人Cameron Adams称,自研模型结合14年数据是护城河,Magic Layers功能验证其价值。Canva要成用户进入AI入口,还会在中国持续投入。

Founder Park
产品应用7

Google 推出超小杯 AI:Gemma 3 270M!可进手机和浏览器

Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在多平台发布,开源策略效果好。

AI工程化
开源动态8

摩尔线程算法一鸣惊人,图形学顶会夺银!已开源

12月17日,在SIGGRAPH Asia 2025上,摩尔线程凭借自研技术LiteGS在3DGS重建挑战赛中获银奖。3DGS是革命性3D场景表示与渲染技术,摩尔线程开源3DGS基础库LiteGS,实现全链路协同优化。

量子位
新闻资讯8

一年前让英伟达蒸发6000亿,一年后被老黄搬上PPT

北京时间1月6日,黄仁勋在CES 2026上展示Kimi K2、DeepSeek V3.2、Qwen等中国模型。此前英伟达因谷歌、Meta等对手的冲击市值蒸发。老黄花200亿美元挖人,用中国开源模型反击,构建开放生态。

AGI Hunt
算法论文8

为什么Agent总是Demo猛如龙实战一条虫?

一篇51页论文研究主要智能体,指出适应性是关键。它提出2×2分类框架将适应方法分四大范式,还明确不同范式优缺点,发现T2范式数据效率远超A2。最后点明Agent适应性研究的四个前沿方向。

量子位
算法论文8

AI写CUDA算子准确率92%,到国产芯片只剩4%?上交方法直线拉升,DeepSeek也适用

GPT-5.2写CUDA算子正确率92%,给华为Ascend NPU写算子仅4%,因公开数据少等致‘新硬件冷启动’难。上海交大团队EvoKernel不训新模型、不标新数据,将GPT-5.2正确率从4%拉到83%,还拓展到DeepSeek架构算子。

机器之心