「性能成本平衡」共找到 3298 篇相关文章
Claude Sonnet 5 上线一日差评刷屏:打不过千问和 Minimax,性价比全面翻车
Claude Sonnet 5发布一天差评多。虽官方定位高,有能力亮点,但在中文测评中性价比低,测试成本高,且Max推理模式易过度思考。还因过度保守失去实用价值,其表现取决于使用场景和预算。
Node.js之父官宣:人类手写代码时代真的结束了!
Node.js之父Ryan Dahl称人类手写代码时代终结,Stability AI创始人Emad Mostaque预测AI编程成本将暴跌,现在每月200美元的体验两年后不到1美元。AI编程虽需大量算力,但成本正快速下降,未来编程或更民主化。
AI Coding 产品的陷阱:有 PMF 但还没有做到 BMPF
AI Coding 产品增长迅速,如 Lovable 预计年底 ARR 达 2.5 亿美金。但也暴露出盈利难题,多数产品利润为负。解决办法要么自建模型,但成本高;要么等大模型成本下降,却不太可行。AI Coding 产品或未实现 BMPF。
手机跑推理模型:Liquid AI发布仅需900MB内存的LFM2.5-1.2B-Thinking
Liquid AI发布LFM2.5 - 1.2B - Thinking推理模型,仅需900MB内存就能在手机运行。它专为简洁推理训练,性能提升明显,多数性能基准超Qwen3 - 1.7B,在多平台表现佳,还支持主流推理框架。
Reasoning模型可以Self-Train!
当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。
安谋科技发布“周易”X3,一场“中庸”的突围 | 甲子光年
11月13日安谋科技发布“周易”X3 NPU IP,专为端侧AI打造。当前端侧AI市场不确定大,芯片设计难平衡专用与通用。“周易”X3采用DSP+DSA融合架构,转向混合浮点,提升带宽,搭配开放软件平台,在多方面找到平衡。
Claude Opus 4.1模型发布,OpenAI继续被拉开差距
Anthropic发布Claude Opus 4.1模型,在各指标上超越Opus 4。Anthropic ARR达50亿美元,API收入首超OpenAI。新模型在多场景有进步,官网等渠道统一可用,还给出Claude Code使用建议。
OpenAI公布首颗自研推理芯片成绩,下一代已进入制造阶段
8月25日,OpenAI公布自研推理芯片Jalapeño性能测试结果,首次给出其在多款公开大模型上的具体数据。该芯片在低功耗下实现高推理吞吐量和低延迟,性能超英伟达芯片,B0版已进入制造阶段。
AI 狂潮中,电子业破局:国产先进封装加速突围
AI应用渗透使算力需求结构重塑,传统芯片技术升级遇阻,先进封装技术成关键。文中介绍DeepSeek架构突破、DeepSeek - R1算法革新,分析其对算力需求的影响,指出高性能算力芯需求仍高,先进封装能释放芯片性能,国产有望突破。
Claude Fable 5.1与GPT-5.6社区一手实测
Anthropic的Claude Fable 5.1刚上线,社区就将其与OpenAI的GPT - 5.6 Sol实战对决。采用同一提示词等严苛规则,结果Fable 5.1细节碾压但有bug,成本高;GPT - 5.6 Sol成本低、风格稳定。还给出选型参考。