@bod 在 ollama pro老套餐额度测试 中发帖
下午又测了下ollama pro老套餐的用量,测试方式是用同一个大请求(150k)调用接口,cache miss是每次请求都改变请求头,模拟缓存未命中的情况,cache hit就是每次都是同样的请求。
结果如下,这算的5h/周token用量 cache hit场景下不准,因为是100%命中缓存,实际场景要少一部分,数量级差不多。
如果主要用deepseek-v4-flash 老套餐一个月能用360刀左右,新套餐贵了6倍。如果是用glm-5.3-flash新套餐贵了2倍。
[image]