gorgiasGLM 5.3 Flash 吹得过头了 中发帖

我不喜欢花时间给新模型试错,我觉得试错成本太高了,但是前段时间很多人都在吹Flash多牛。然后我特地去搜GLM 5.3 Flash的吐槽帖,只有少数人反馈说效果不好。 
后来我高强度测试了在我看来,不会比DeepSeek V4 Flash好多少,它的有点就是工具的调用准确,稳定性好。拿来做最简单的工作比较合适:比如信息收集、单一的问题分析、git commit之类的。
我之前一直用GLM 5.2做逆向和代码分析,也会用它开发代码。GLM 5.2在安全领域经验不足,但从未极蠢的情况,我一直都放心让它7x24运行,一般会加一个KIMI K3或者Codex作为监督(前段GPT时间Cyber告警了,只能用回K3)
之前给它一个Design.md,它乱改,直接在代码里面内联样式。
比如我给它提供源代码,让它把Windows GUI移植到Linux上,它就做不好,甚至乱创建目录,搞的乱七八糟。
...