首先我是 GLM V1 版本套餐的老用户,不是这个套餐的可能不是很适用。
最近 Lite 版本的套餐也能用到 GLM5.3 了,说是完全还是 GLM5.2 的预训练基座,但是通过 RL 达到原 GLM5.2 超越 50% 的性能。
我周末高强度使用了一下,确实强多了。
主要是最近用 Godot 做一个自己爱玩的游戏,之前只敢用 GPT 5.6 Sol 来改。用 GLM5.2 改的话,报错频率很高,还得提醒它自己看编译报错,改得也不完全,总是会有遗漏。
5.3 强多了,基本不报错,而且意图理解也比之前强了很多。
那么问题来了。
V1 老套餐 Lite 只有 5h 限额,使用 ZCode 是 1.5x 限额,大概是 5000 万 token 。
这在高峰期(工作日 14:00-18:00 )明显不够用。
而智谱的 5h 限额有个特点:下一个周期到来时,你得实际用一下,才开始计算新的周期。
也就是说,可以通过 ZCode 自带的定时任务,把下午的高峰期完美拆解成两个 5h 限额的上下半段。
我现在的配置是这样的:

通过这样的配置:
早上可以用一个完整的 5h 限额,一直到 10 点。
然后 10 点半到下午 3 点半,又是一个完整的 5h 限额。
下午 3 点半到 6 点,又是一个完整的 5h 限额。
这样基本就把工作时间覆盖掉了。
最后一个提醒,ZCode 的上下文上限很大,1000K ,实际上完全用不到。
可以手动 `/compact` 压缩上下文,频繁一点,也能有效减少 token 消耗。
这样完美压榨 GLM 的 token 后,还是不够用的话,就 Codex 。
现在 Codex 只有周限额,关键时刻也能顶一顶。
最近 Lite 版本的套餐也能用到 GLM5.3 了,说是完全还是 GLM5.2 的预训练基座,但是通过 RL 达到原 GLM5.2 超越 50% 的性能。
我周末高强度使用了一下,确实强多了。
主要是最近用 Godot 做一个自己爱玩的游戏,之前只敢用 GPT 5.6 Sol 来改。用 GLM5.2 改的话,报错频率很高,还得提醒它自己看编译报错,改得也不完全,总是会有遗漏。
5.3 强多了,基本不报错,而且意图理解也比之前强了很多。
那么问题来了。
V1 老套餐 Lite 只有 5h 限额,使用 ZCode 是 1.5x 限额,大概是 5000 万 token 。
这在高峰期(工作日 14:00-18:00 )明显不够用。
而智谱的 5h 限额有个特点:下一个周期到来时,你得实际用一下,才开始计算新的周期。
也就是说,可以通过 ZCode 自带的定时任务,把下午的高峰期完美拆解成两个 5h 限额的上下半段。
我现在的配置是这样的:

通过这样的配置:
早上可以用一个完整的 5h 限额,一直到 10 点。
然后 10 点半到下午 3 点半,又是一个完整的 5h 限额。
下午 3 点半到 6 点,又是一个完整的 5h 限额。
这样基本就把工作时间覆盖掉了。
最后一个提醒,ZCode 的上下文上限很大,1000K ,实际上完全用不到。
可以手动 `/compact` 压缩上下文,频繁一点,也能有效减少 token 消耗。
这样完美压榨 GLM 的 token 后,还是不够用的话,就 Codex 。
现在 Codex 只有周限额,关键时刻也能顶一顶。
