GLM 系列是什么
Z.ai 的 GLM 系列既出现在厂商自己的免费层,也出现在托管其开放权重的第三方平台上——这是本目录里同一系列以两种完全不同方式免费的最清楚例子。
以免费条款提供 GLM 的服务商
本清单详列的 25 家服务商里,有 3 家至少提供一个 GLM 模型。因为 Z.ai 公开的是权重而不是服务,所以 model id 在这些家之间可以完全一致,免费额度却不一样。
| 服务商 | 免费形式 | 官方公布限额 | 信用卡 | 匹配到的模型 |
|---|---|---|---|---|
| SiliconFlow | 厂商免费额度 | 每分钟 1000 次请求 | 不需要 | THUDM/GLM-4-9B-0414 |
| Z.AI Open Platform | 厂商免费额度 | 部分模型标价为零 | 不需要 | GLM-4.7-Flash、GLM-4.5-Flash、GLM-4.6V-Flash |
| Chutes | 按量计费 | 按付费计划公布 | 不需要 | zai-org/GLM-5 |
免费条款到底差在哪
- SiliconFlow — 免费模型的限流是固定值;付费模型按月消费分层,L0 起步为 1,000 RPM、40,000 TPM。
- Z.AI Open Platform — GLM-4.7-Flash、GLM-4.5-Flash 和视觉模型 GLM-4.6V-Flash 在官方定价表上的输入、缓存输入、缓存输入存储和输出四列都标着 $0,也就是真的免费调用,不是打折。
- Chutes — Chutes 按 token 计费,并出售包含每日额度的订阅计划:Plus 每月 10 美元,含一份每日额度,超出部分在按量价上打 94 折;Pro 每月 20 美元,每日额度更大,超出部分打 9 折。
怎么挑一家
这 3 家里有 1 家公布了固定的请求次数,其余的只给出层级或额度余额,也就是说「到底免费多少」唯一诚实的答案在它们各自的控制台里。有 3 家不要信用卡。有 3 家会响应跨域浏览器请求,所以这些家的 key 不用装任何东西,直接在浏览器检测页里就能验。
model id 匹配上 GLM,并不等于承诺免费额度里就包含它。服务商会在不改 id 的情况下把某个模型在付费和免费之间挪动,所以每一行都链回对应的服务商页面,那里放着该服务商自己的原话和读取日期。
免费额度用完之后是什么价
上面这些免费额度都有到头的一天,而 GLM 到那时候是什么价,不在本清单的追踪范围内。下面是公开报道过的价钱,连着它出处的整句原话一起引——出自同一维护者整理的那张表,那里每个数都带着自己那句话:
| 价格 | 它出自的那句原话 | 对应长文 |
|---|---|---|
$1 per million tokens |
Top-tier Chinese models such as GLM5.2 and DeepSeek V4 Pro sit near $1 per million tokens at inference gross margins of 10% to 20%. | 1.6 Billion Free Tokens Is a Compression Ratio, Not a Strategy |
要算的那笔账不是 GLM、是别的?一句话说出它的名字——只有一格要填,下一个去查的价钱按谁问了排。