GLM 系列是什么
Z.ai 的 GLM 系列既出现在厂商自己的免费层,也出现在托管其开放权重的第三方平台上——这是本目录里同一系列以两种完全不同方式免费的最清楚例子。
以免费条款提供 GLM 的服务商
本清单详列的 25 家服务商里,有 4 家至少提供一个 GLM 模型。因为 Z.ai 公开的是权重而不是服务,所以 model id 在这些家之间可以完全一致,免费额度却不一样。
| 服务商 | 免费形式 | 官方公布限额 | 信用卡 | 匹配到的模型 |
|---|---|---|---|---|
| SiliconFlow | 厂商免费额度 | 每分钟 1000 次请求 | 不需要 | THUDM/GLM-4-9B-0414 |
| Z.AI Open Platform | 厂商免费额度 | 部分模型标价为零 | 不需要 | GLM-4.7-Flash、GLM-4.5-Flash |
| Cerebras Inference | 注册赠送额度 | 每分钟 5 次请求 | 需要 | zai-glm-4.7 |
| Chutes | 按量计费 | 按付费计划公布 | 不需要 | zai-org/GLM-5 |
免费条款到底差在哪
- SiliconFlow — 免费模型的限流是固定值;付费模型按月消费分层,L0 起步为 1,000 RPM、40,000 TPM。
- Z.AI Open Platform — 官方定价表把 GLM-4.7-Flash 和 GLM-4.5-Flash 的输入、缓存输入与输出都标成 $0,也就是真的免费调用,而不只是打折。
- Cerebras Inference — 免费试用的限额是每个模型 5 RPM、30K TPM,并有每小时 100 万 token、每天 100 万 token 的封顶,适用于 gpt-oss-120b、zai-glm-4.7 和 gemma-4-31b。
- Chutes — Chutes 按 token 计费,并出售包含每日额度的订阅计划:Plus 每月 10 美元,含一份每日额度,超出部分在按量价上打 94 折;Pro 每月 20 美元,每日额度更大,超出部分打 9 折。
怎么挑一家
这 4 家里有 2 家公布了固定的请求次数,其余的只给出层级或额度余额,也就是说「到底免费多少」唯一诚实的答案在它们各自的控制台里。有 3 家不要信用卡。有 4 家会响应跨域浏览器请求,所以这些家的 key 不用装任何东西,直接在浏览器检测页里就能验。
model id 匹配上 GLM,并不等于承诺免费额度里就包含它。服务商会在不改 id 的情况下把某个模型在付费和免费之间挪动,所以每一行都链回对应的服务商页面,那里放着该服务商自己的原话和读取日期。