新闻资讯7
国产3B小模型编程能力比肩大模型
机器之心
AI 摘要
新浪微博团队推出国产小模型VibeThinker - 3B,虽参数仅30亿,但在编程等推理任务上比肩前沿大模型,训练有独特流程,不过在通用知识领域表现一般,为小模型研究提供新思路。
阅读原文 · 机器之心
3B小模型,编程得分比肩Opus 4.5,神秘模型引发热议,原是国产
最近,3B小模型VibeThinker - 3B在X上火了,它在编程等推理任务上比肩前沿大模型,体积却小很多。它是国产模型,来自新浪微博团队,在各项基准测试表现出色,不过在通用知识领域表现欠佳。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态8
智谱、阿里新模型亮相,性能屠榜!
智谱发布GLM - 5.3 - Flash(牛来模型),原生多模态,支持1M token上下文,运行在国产芯片,价格实惠。阿里开源Qwen3.8 - Flash - Next权重,成本低性能优,在四大维度重构架构。
AI寒武纪
开源动态8
Qwen3.8-Max下周开源,能力全面提升
Qwen3.8-Max是Qwen家族迄今最强模型,2.4万亿参数,下周将开源权重。它在多项基准测试中表现出色,能连续自主工作数天,在编程、办公、科研、长周期任务、多模态等方面全面提升。
AIGC开放社区
推荐文章7
烧钱评测:国模格局或改写
作者花大成本从后端、人味、前端、推理等维度,对glm 5.2、kimi k3等国产模型进行测试,展示各模型在不同测试中的结果,指出国模2T俱乐部的kimi和qwen下限高,且刻板印象需改变。
探索AGI
开源动态8
南北阁实验室:Nanbeige4.2 - 3B小模型挑战大任务
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。
AIGC开放社区