首先我是 GLM V1 版本套餐的老用户,不是这个套餐的可能不是很适用。
最近 Lite 版本的套餐也能用到 GLM5.3 了,说是完全还是 GLM5.2 的预训练基座,但是通过 RL 达到原 GLM5.2 超越 50% 的性能。
我周末高强度使用了一下,确实强多了。
主要是最近用 Godot 做一个自己爱玩的游戏,之前只敢用 GPT 5.6 Sol 来改。用 GLM5.2 改的话,报错频率很高,还得提醒它自己看编译报错,改得也不完全,总是会有遗漏。
5.3 强多了,基本不报错,而且意图理解也比之前强了很多。
那么问题来了。
V1 老套餐 Lite 只有 5h 限额,使用 ZCode 是 1.5x 限额,大概是 5000 万 token 。
这在高峰期(工作日 14:00-18:00 )明显不够用。
而智谱的 5h 限额有个特点:下一个周期到来时,你得实际用一下,才开始计算新的周期。
也就是说,可以通过 ZCode 自带的定时任务,把下午的高峰期完美拆解成两个 5h 限额的上下半段。
我现在的配置是这样的:
通过这样的配置:
早上可以用一个完整的 5h 限额,一直到 10 点。
然后 10 点半到下午 3 点半,又是一个完整的 5h 限额。
下午 3 点半到 6 点,又是一个完整的 5h 限额。
这样基本就把工作时间覆盖掉了。
最后一个提醒,ZCode 的上下文上限很大,1000K ,实际上完全用不到。
可以手动 `/compact` 压缩上下文,频繁一点,也能有效减少 token 消耗。
这样完美压榨 GLM 的 token 后,还是不够用的话,就 Codex 。
现在 Codex 只有周限额,关键时刻也能顶一顶。
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
https://www.v2ex.com/t/1236832
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.