新捏 (@xNie) 在 发现ZCODE免费额度变耐用的奥秘! 中发帖
因为送的这个叼毛额度是缓存也算的,所以之前1亿的时候,如果抵着一个会话跑其实不耐用,这次3亿的赠送给我摸到了奥秘!
在【设置】-【模型设置】;
点击这个模型下面的编辑;
[image]
修改【上下文窗口】,尽早触发上下文压缩。
[image]
我现在写的400K,感觉有规划tasks的情况下,没有什么差别。
因为这种flash模型,其实不一定是原生1M的,有专注力问题,所以把上下文缩小不会对性能有太大影响。