あ (@VimCoder)ds-v4-pro max、glm5.3、kimi k3魔方测试 中发帖

渠道均是OpenCode Go订阅,感觉现在魔方测试效果都还不错了诶 
deepseek-v4-pro(加了双赛博眼睛),思考强度选择Max,用时:34分(做了大量验证工作)
glm5.3+Zcode,思考强度:Max,用时:44分16秒(也是做了大量验证工作)
Kimi K3+Kimi Code,思考强度选择Max,用时:23分05秒(验证工作做得少)
验证工作主要是harness设计导致的,总体来看做的效果都挺好的,感觉国产模型也是越来越好起来了