Tco3Deepseek V4 Pro,GLM5.2,5.6Sol/Terra凑一桌麻将谁会赢呢(娱乐小测试,不代表模型真实水平) 中发帖

突发奇想用Codex搭了一个可以让模型通过工具调用打麻将的项目,跑成功之后开始更,不定时更新,bug太多就鸽了)))规则是gpt家固定medium思考参数,国模固定high推理参数,一局内每个模型有且只有一次机会选择启用Max思考参数 
[f0d410daf99ae3038a36acf8ac8e1b4e]