JXMs Qwen 3.8 Max的简单小评测 中发帖

前两天看3.8出来了,而且宣传碰瓷fable,把我好奇心勾起来了,直接豪掷139购入token plan套餐,使用我当前的个人项目进行了一轮审查方面的评估(就是让Qwen 3.8 Max彻底检查我的项目,找出问题)。 
对手方面我给他找了讯飞coding plan里的glm-5.2,裁判我选的O社官方gpt-5.6 Sol Max。
他们两个分别的报告我就不放了,太占地方,直接给裁判的结论(A是glm,B是Qwen):
## 结论

按“可复核事实 50% + 因果/严重度校准 30% + 范围与证据链 20%”评分:

报告 准确性评分 结论
━━━━━━ ━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
A 86/100 具体代码缺陷命中率高,但审...