(2026-08-27)最近集中发布的高性价比 flash 模型

6 小时 53 分钟前
 yidinghe

最近接连出现两个高性价比的 -flash 模型,价格也非常亲民。

一个是之前的神秘“牛来”模型,现已正式确认是 GLM-5.3-Flash 。文档页面 https://docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash 价格页面 https://bigmodel.cn/pricing 原价输入 0.8 元,输出 2.8 元,缓存命中 0.23 元,限时五折,但是请求量太大现在根本没办法用。

然后是阿里的 qwen3.8-flash 。文档页面 https://www.qianwenai.com/models/qwen3.8-flash 输入 1 元,输出 3 元,缓存命中 0.1 元。

我想提醒一下:如果你的缓存命中率很高,那就要更多关注缓存命中价格,这个才是大头。举个例子,假设你的用量方式为 600M 输入,6M 输出,95% 命中率,那么用 GLM-5.3-Flash 的总费用是 171.9 元,而 qwen3.8-flash 的总费用是 105 元。两个都是 Flash 就不纠结表现差距了。

2380 次点击
所在节点    程序员
16 条回复
lujiaosama
6 小时 50 分钟前
可惜 DSV4FLASH 涨价了
zhaosong
6 小时 13 分钟前
这么看来 gemini 3.7 flash 属实是没啥出路了
levn
6 小时 9 分钟前
300b 、200b 、100b 、35b, 都叫 flash
foryou2023
6 小时 5 分钟前
还是没有梁文谷便宜。
SilentOrFight
6 小时 2 分钟前
在千问办公深度体验过 qwen3.8max ,依托答辩吧,qwen 模型写桌面客户端是真的垃圾
liuidetmks
5 小时 52 分钟前
现在最便宜的就是 mimo 了吧?
duanxianze
5 小时 49 分钟前
GLM-5.3-Flash 试用了一下 思考起来慢的离谱啊 是因为用的人太多了还是啥?
zzutmebwd
5 小时 46 分钟前
@levn 在我看来能不能叫 flash 看推理速度就行了,超过 100tps 的大模型都可以叫 flash 。推理速度主要看激活量的,qwen 3.8 flash next 激活量只有 6b ,在单张 pro6000 上预填充破万,解码 150tps ,还有很大优化空间,目测最终能破 200tps ,确实很稀疏推理很快。
maocat
5 小时 44 分钟前
只能说是回旋镖了,DSV4 正式版那天,glm 全线涨价,DS 开始涨价后,GLM 又出廉价的模型了,乐
longaiwp
5 小时 43 分钟前
@liuidetmks 智力太低下了,比 Gemini 都更流口水
longaiwp
5 小时 43 分钟前
@foryou2023 比梁文峰也没好特别多
coefu
5 小时 29 分钟前
qwen3.8 flash 没资源,跑不动,就很烦。😔
ijrou
4 小时 20 分钟前
说真的,qwen3.8-flash 也没比 deepseek-v4-flash-0731 的闲时时段便宜到哪里去...
yidinghe
4 小时 11 分钟前
@ijrou 对上班族来说闲时没意义
shineben
2 小时 40 分钟前
三个都使用了半天,感觉还是 DeepSeek-flash 强点
cryboy007
50 分钟前
我现在 openClaw 是用 gemini3.7flash. 感觉完全用不完。配合 antigravity-tools 。大概买了 3 个 pro 账号,一个账户一年 10 块钱。有我这个便宜么/就是不知道和上述的 glm qw 的差距

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1237519

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX