lucas (@lucasli) 在 来个astra tips: 如何在codex gpt-astra对话过程中切换思考深度而不丢失缓存 中发帖
直接上方案,config.toml中添加:
[features]
reasoning_effort_override = true
验证: medium 聊一轮 → high 聊一轮 → low 聊一轮。
全程保持同一个模型、同一个会话,避开上下文压缩。
然后把这段话交给本地 Codex:
“读取刚才测试会话的日志,检查是否出现 configuration_update;按请求列出思考档位、输入 tokens、缓存输入 tokens 和缓存比例。重点比较切档后的第一次请求,不要用整个会话的累计比例代替。日志缺失的字段请直接标明。”
看到开关为 true,只代表配置开启。看到 configuration_update,说明客户端已发送更新。