Kevvvin Yaoollama pro的glm 5.2用量测试 中发帖

测试于2026年8月9日。 
调用方式:先接入sub2api,然后接入opencode review, cc switch, cursor, open webui。
主要消耗于claude code,cursor和open code review
用量(图1):5h跑满。周限额跑了17.9%
有几次请求其他模型,但主要是glm 5.2
token数量(图2)来自于sub2api统计。里面的g3是我为了让在cursor中使用起的别名,做了模型映射。
5h: 24.42 + 11.71 = 36.13m
周限额:36.13m / 17.9% = 202m
也就是周限额2亿token。
智谱官方lite套餐(图3)最多包含0.87亿token。价格略微低于ollama。
只做参考,欢迎大家讨论。
另外就是感觉响应速度还挺快的,比之前的glm 5.1好很多。不过还是比grok ...