产品应用8
aiX - apply - 4B逆袭DeepSeek - V3.2,单卡提效15倍
机器之心
AI 摘要
硅心科技:发布aiX - apply - 4B代码变更应用模型,平均准确率93.8%,超越Qwen3 - 4B和DeepSeek - V3.2,算力成本低、推理快,还构建小模型矩阵,用“大+小”架构释放算力价值。
阅读原文 · 机器之心
aiX-apply-4B逆袭DeepSeek-V3.2!aiXcoder发布代码变更应用模型,单卡推理提效15倍
3月25日,硅心科技发布专为代码变更应用场景设计的模型aiX - apply - 4B。它平均准确率达93.8%,超越Qwen3 - 4B和DeepSeek - V3.2,算力成本仅为后者5%,推理速度提15倍。还采用创新训练方法,适配企业场景。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
产品应用7
亿级DAU应用靠跨云架构砍75% GPU集群
一家AI穿搭+购物推荐的出海应用DAU破亿,但算力和传输成本高,ARPU远低于成本。该企业转向Akamai推理云,换用RTX PRO 6000,缩减服务器集群,降低成本,采用跨云架构过渡,实现零阵痛平替。
量子位
开源动态8
南北阁实验室:Nanbeige4.2 - 3B小模型挑战大任务
在模型越做越大的当下,推理成本成了影响Agent大规模使用的关键因素。南北阁实验室推出Nanbeige4.2 - 3B,在架构、数据构造和训练pipeline层面做了系统工作,评测表现良好,还探索本地个人助手等应用。
AIGC开放社区
开源动态8
MonkeyOCRv2:0.7B参数反超3B称霸文档OCR
文档OCR正迈入小模型时代,MonkeyOCRv2以0.7B、0.6B参数在MDPBench上超越3B模型。它重新分配系统职责,采用互补预训练目标,还开源训练数据,且迁移到多任务表现良好。
量子位
开源动态8
微博开源3B小模型,性能逼近大模型
微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。
AIGC开放社区