产品应用7
Qwen3.7-Max:综合能力强,版本方向超对!
探索AGI
AI 摘要
作者:Qwen3.7-Max补齐短板,综合能力强。审美提升,代码质量不错,长程思考推理迭代能力佳,适合替换到部分工具,该版本方向很对。
阅读原文 · 探索AGI
说实话提前拿到Qwen3.7-Max内测,最让我意外的不是它推理变强了!
作者提前2天拿到Qwen3.7-Max内测,经测试,该版本补齐短板,综合能力强。审美提升明显,代码质量不错,长程思考推理迭代能力佳,适合替换到部分工具里。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯8
Opus 5通关测试:强模型需简单环境
ARC Prize官方给Opus 5的ARC - AGI - 3成绩为30.2%,但开发者Jeremy Berman让其借助电脑,正确率飙升至96.2%。还开源代码,换用Codex等测试效果差。表明模型强时,简单环境更佳。
新智元
新闻资讯7
三款LLM新品发布,社区实测性能大比拼
LLM大爆发,一天内推出Grok 4.6、Qwen3.8 - Max、DeepSeek - V4 - Pro - 0813三款前沿产品。社区对它们进行多场景测试,如3D场景、Flappy游戏、飞机滑行动画等,并对比了不同模型的性能、价格和输出质量。
PaperAgent
新闻资讯7
技术专家共探 AI Coding 应用关键问题
InfoQ《极客有约》X AICon 直播栏目,邀网易游戏林香鑫等探讨 Coding Agent 重构软件工程环节。嘉宾分享了 AI Coding 在生产环境的变化、MCP 等概念作用、代码质量保障、Agent 权限及 AI 原生研发体系建设等观点。
InfoQ
推荐文章7
烧钱评测:国模格局或改写
作者花大成本从后端、人味、前端、推理等维度,对glm 5.2、kimi k3等国产模型进行测试,展示各模型在不同测试中的结果,指出国模2T俱乐部的kimi和qwen下限高,且刻板印象需改变。
探索AGI