Kimi ¥199 vs Ollama Pro: K3 额度实测

23 小时 38 分钟前
 dongzhimin

控制变量:相同 CLIProxyAPI 、相同请求、high推理、单并发、无缓存、无重试、关闭超额付费。

指标 Kimi K3 1M Kimi K3-256K Ollama Pro K3
月费 ¥199 ¥199 $20
数据来源 实测 半费率推算 实测
5 小时工作单元 24 约 48 19
5 小时成功请求 72 约 144 57
5 小时输入量 218 万 tokens 约 436 万 173 万 tokens
5 小时池占周额度 20% 预计 20% 约 18%
每周 5 小时池 5 个 5 个 约 5.56 个
每周工作单元 120 约 240 约 105.6
平均每月工作单元 约 522 约 1,044 约 459
平均每月等效输入 约 4,750 万 约 9,500 万 约 4,190 万 tokens
平均延迟 12.85 秒 未实测 3.54 秒
相对月容量 100% 约 200% 约 88%

结论:

注:k3-256kKimi 官方所述的约半费率推算,并非本轮实测。月额度按平均每月 4.35 个周窗口计算; Kimi 其他会员功能会共享月度额度池。

1530 次点击
所在节点    程序员
7 条回复
SiWXie
22 小时 41 分钟前
Ollama 用 glm 是最值的,又快又满血。kimi 套餐内的 k3 额度工作日高峰期很慢很慢,用这玩意,你就在那泡茶喝吧。
dongzhimin
22 小时 38 分钟前
@SiWXie ollama 模型还多,年付才 200.目前确实是一个能保留的订阅
SiWXie
22 小时 36 分钟前
@dongzhimin #2 是的,毕竟服务器在美国,也不缺卡,缺点是它是动态额度,你今天测的,下个月再测试可能会不一样,它是按 gpu 使用时计费的
12101111
22 小时 24 分钟前
实测 k3 256k 并非半费率,而是 k3 1M 在超过 256K 时费率更高,如果保证在 256K 内,费率相同
287854442
21 小时 39 分钟前
输出数据有吗,主要得看输出 token 量吧?
WispZhan
21 小时 37 分钟前
试试低费率模型,比如 GLM-5.3-flash
kneo
8 小时 16 分钟前
没有缓存,输出,这个感觉估算不出来值多少 API 价格。

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://www.v2ex.com/t/1237940

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX