浮墨败笔 (@QixYuan) 在 关于上下文管理/计费和Token的疑惑,求解 中发帖
我自己尝试手搓react 后,想加一个深度研究功能
现在以agent + skill 驱动的思路做好了这个功能
跑一轮下来AI帮我分析说会有 4M的Token?
其中一共跑了81个轮次
核心问题是每轮都重新发送增长中的主 Agent 历史:
第 1 轮:system + 用户问题
第 2 轮:前面内容 + 推理 + 工具结果
第 3 轮:前面全部内容 + 新推理 + 新工具结果
……
第 81 轮:累计到约 8 万 Token
即使最后一轮只有约 8 万,81 轮求和也很容易达到 400 多万。这是典型的“梯形
累计”:
约 81 × 平均 5.7 万 ≈ 463 万输入
普通输入的大致组成是:
工具结果:约 47.8%,约 177 万
Assistant 历史:约 35.7%,约 132 万
工具 Schema:约 8.4%,约 31 万
其他上下文:约 8...