Google AI Studio 为每个账号提供 Gemini 模型的免费档,按天重置请求额度,不同模型限额不一样。Gemini 3.1 Flash Lite 、Gemini 3.5 Flash Lite 、Gemma 4 模型限制更宽松一些,其它模型限制比较严。
需要手机号验证,少部分模型可免费使用,比如:gemma4 、gpt-oss:20b 目前观察应该是 2 周重置一次,额度中规中矩。
只有标注了 :free 后缀的模型可以免费使用,厂商发布新模型时通常会在 OpenRouter 限免,但免费模型速度可能较慢,免费模型稳定性可能一般。
提供的免费模型比较多,Hobby 计划提供每月 5$免费调用额度,但需要绑卡验证。
部分模型可免费调用,速度很快,但是 Cerebras 不支持中国用户注册和使用,需要自行用魔法。
每个 Cloudflare 账号每天免费 10k 神经元,可调用部分开源模型,但是上手很复杂,速度一般,不建议新手折腾。
少部分模型可免费调用,优点是速度贼快,但是现在限额比较严重。
AMD Radeon Cloud 和 NVIDIA NIM 也有部分模型可以免费提供调用。
免费模型速度和稳定性一般比较差,而且有的模型很旧,但依然可用于一些特殊的场景,比如翻译、图片信息识别和提取等场景。
个人实测后比较推荐:Google AI Studio 、Ollama Cloud 、Vercel AI Gateway
我将我目前使用过的一些模型全部整理到了 AI 情报局的单独页面:https://rss.bz/zh/free-llm-apis 后续会持续更新,有需要的话可以收藏关注。如果有错漏,还请指正,谢谢各位。
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.