Z.ai · 本清单收录 4 家

GLM 免费 API 访问

本清单里所有以免费条款提供 GLM 模型的服务商,以及各自公布的限额。

GLM 系列是什么

Z.ai 的 GLM 系列既出现在厂商自己的免费层,也出现在托管其开放权重的第三方平台上——这是本目录里同一系列以两种完全不同方式免费的最清楚例子。

以免费条款提供 GLM 的服务商

本清单详列的 25 家服务商里,有 4 家至少提供一个 GLM 模型。因为 Z.ai 公开的是权重而不是服务,所以 model id 在这些家之间可以完全一致,免费额度却不一样。

服务商免费形式官方公布限额信用卡匹配到的模型
SiliconFlow 厂商免费额度 每分钟 1000 次请求 不需要 THUDM/GLM-4-9B-0414
Z.AI Open Platform 厂商免费额度 部分模型标价为零 不需要 GLM-4.7-Flash、GLM-4.5-Flash
Cerebras Inference 注册赠送额度 每分钟 5 次请求 需要 zai-glm-4.7
Chutes 按量计费 按付费计划公布 不需要 zai-org/GLM-5

免费条款到底差在哪

  • SiliconFlow — 免费模型的限流是固定值;付费模型按月消费分层,L0 起步为 1,000 RPM、40,000 TPM。
  • Z.AI Open Platform — 官方定价表把 GLM-4.7-Flash 和 GLM-4.5-Flash 的输入、缓存输入与输出都标成 $0,也就是真的免费调用,而不只是打折。
  • Cerebras Inference — 免费试用的限额是每个模型 5 RPM、30K TPM,并有每小时 100 万 token、每天 100 万 token 的封顶,适用于 gpt-oss-120b、zai-glm-4.7 和 gemma-4-31b。
  • Chutes — Chutes 按 token 计费,并出售包含每日额度的订阅计划:Plus 每月 10 美元,含一份每日额度,超出部分在按量价上打 94 折;Pro 每月 20 美元,每日额度更大,超出部分打 9 折。

怎么挑一家

这 4 家里有 2 家公布了固定的请求次数,其余的只给出层级或额度余额,也就是说「到底免费多少」唯一诚实的答案在它们各自的控制台里。有 3 家不要信用卡。有 4 家会响应跨域浏览器请求,所以这些家的 key 不用装任何东西,直接在浏览器检测页里就能验。

model id 匹配上 GLM,并不等于承诺免费额度里就包含它。服务商会在不改 id 的情况下把某个模型在付费和免费之间挪动,所以每一行都链回对应的服务商页面,那里放着该服务商自己的原话和读取日期。