最近接连出现两个高性价比的 -flash 模型,价格也非常亲民。
一个是之前的神秘“牛来”模型,现已正式确认是 GLM-5.3-Flash 。文档页面 https://docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash 价格页面 https://bigmodel.cn/pricing 原价输入 0.8 元,输出 2.8 元,缓存命中 0.23 元,限时五折,但是请求量太大现在根本没办法用。
然后是阿里的 qwen3.8-flash 。文档页面 https://www.qianwenai.com/models/qwen3.8-flash 输入 1 元,输出 3 元,缓存命中 0.1 元。
我想提醒一下:如果你的缓存命中率很高,那就要更多关注缓存命中价格,这个才是大头。举个例子,假设你的用量方式为 600M 输入,6M 输出,95% 命中率,那么用 GLM-5.3-Flash 的总费用是 171.9 元,而 qwen3.8-flash 的总费用是 105 元。两个都是 Flash 就不纠结表现差距了。
