最近探索出来使用 GLM 的正确姿势

3 小时 58 分钟前
 codingerj
首先我是 GLM V1 版本套餐的老用户,不是这个套餐的可能不是很适用。

最近 Lite 版本的套餐也能用到 GLM5.3 了,说是完全还是 GLM5.2 的预训练基座,但是通过 RL 达到原 GLM5.2 超越 50% 的性能。

我周末高强度使用了一下,确实强多了。

主要是最近用 Godot 做一个自己爱玩的游戏,之前只敢用 GPT 5.6 Sol 来改。用 GLM5.2 改的话,报错频率很高,还得提醒它自己看编译报错,改得也不完全,总是会有遗漏。

5.3 强多了,基本不报错,而且意图理解也比之前强了很多。

那么问题来了。

V1 老套餐 Lite 只有 5h 限额,使用 ZCode 是 1.5x 限额,大概是 5000 万 token 。

这在高峰期(工作日 14:00-18:00 )明显不够用。

而智谱的 5h 限额有个特点:下一个周期到来时,你得实际用一下,才开始计算新的周期。

也就是说,可以通过 ZCode 自带的定时任务,把下午的高峰期完美拆解成两个 5h 限额的上下半段。

我现在的配置是这样的:



通过这样的配置:

早上可以用一个完整的 5h 限额,一直到 10 点。

然后 10 点半到下午 3 点半,又是一个完整的 5h 限额。

下午 3 点半到 6 点,又是一个完整的 5h 限额。

这样基本就把工作时间覆盖掉了。

最后一个提醒,ZCode 的上下文上限很大,1000K ,实际上完全用不到。

可以手动 `/compact` 压缩上下文,频繁一点,也能有效减少 token 消耗。

这样完美压榨 GLM 的 token 后,还是不够用的话,就 Codex 。

现在 Codex 只有周限额,关键时刻也能顶一顶。
333 次点击
所在节点    智谱
2 条回复
duuu
3 小时 55 分钟前
上下文的,应该可以自己修改上限,就不用手动 compact 了
codingerj
3 小时 4 分钟前
@duuu 哦,是的,我改成 400k 了 但是感觉好像也有点大,改成 200k 又体现不出来长上下文的优势了

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1236832

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX