ERIC星辰 (@EricChoi)智谱的 ZCode,跑一个登录页的开发任务,这样的消耗是不是不对? 中发帖

一个登录页用了 4M token,我让GPT帮我分析了以下,他说主要问题出在每次读取文件的时候,都把之前的缓存重新读一遍; 
[image]
对,这张图 + 你上传的 JSONL 日志一结合,结论就比较明确了:

> **4M token 是真实的累计消耗,但不是“这个登录页生成了 4M token”。主要原因是 Agent 在 53 次左右的模型请求中,反复携带不断增长的上下文。**

我把日志实际统计了一下:

| 指标 | 实际值 |
| ---------------- | --------------------: |
| 模型请求数 | **53 次** |
| 累计 input tokens | **3,884,017** |
| 累计 out...