Java 8 (@xuanx) 在 国产模型赶上来的代价就是雷霆大思考 中发帖
最近一直在使用glm-5.3,kimi-k3,qwen-3.8
虽然每个模型开最大思考能力已经赶上来了
但是每个模型都会雷霆大思考
甚至遇到一个问题设置400k上下文问题中合并的情况
最近一直在使用glm-5.3,kimi-k3,qwen-3.8
虽然每个模型开最大思考能力已经赶上来了
但是每个模型都会雷霆大思考
甚至遇到一个问题设置400k上下文问题中合并的情况