产品应用7
GLM - 5.2测试表现出色,比肩闭源旗舰
AI产品黄叔
AI 摘要
AI产品黄叔:用两道真题考GLM - 5.2、Opus 4.8和GPT 5.5。审计Skill体系,GLM - 5.2表现佳;做世界杯夺冠推演器网站,各模型各有优劣,GLM - 5.2开源且性价比高,能与闭源旗舰比肩。
阅读原文 · AI产品黄叔
出了两道真题考 GLM-5.2,Opus 4.8 和GPT 5.5 陪跑
作者对GLM - 5.2、Opus 4.8和GPT 5.5进行两项测试。一是审计Skill体系,GLM - 5.2覆盖skill数多、找出冲突多,还挖出bug;二是做世界杯夺冠推演器网站,Opus表现出色,GLM - 5.2省token,Codex有巧思但结构有缺陷。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态8
智谱 GLM - 5.3 Flash 开源,低价高能来袭
Ox Alpha 匿名模型上线 OpenRouter 后表现亮眼,消耗大量 tokens 并终结 DeepSeek 霸榜纪录。官方揭晓其为智谱 GLM - 5.3 Flash,价格低、能力强,经多场景测试,多模态理解等维度达顶尖水平。
歸藏的AI工具箱
开源动态8
港科大同腾讯开源3D构建框架超GPT - 5.5
香港科技大学(广州)联合腾讯AI平台部提出VibeWorlding,是可通过多轮对话等自主构建和编辑交互式3D世界的多模态智能体框架。团队开源多项数据,其模型经强化学习后表现超GPT - 5.5等。
机器之心
产品应用7
黄益贺:本地部署Qwen 3.8 27B方案揭秘
Qwen 3.8 27B是性能好、体积小的开源模型,个人也能本地部署。本地跑开源大模型,重点看容量和带宽两个指标,还介绍了Mac、RTX 5090、RTX PRO 6000三种部署方案及优缺点。
newtype AI
新闻资讯8
OpenAI亲儿子自研模型选中国K3
OpenAI投资的法律AI公司Harvey,首个自研模型Harvey Tenet选中国开源模型Kimi K3作底座。因原用闭源模型成本高、有竞争风险。Tenet训练成本低、性能佳,显示出可复制路径。
新智元