OpenAI · 本清单收录 10 家

gpt-oss 免费 API 访问

本清单里所有以免费条款提供 gpt-oss 模型的服务商,以及各自公布的限额。

gpt-oss 系列是什么

gpt-oss 是 OpenAI 发布的开放权重模型,在本目录里被托管的服务商数量最多,也是最容易在没有 OpenAI 账号的情况下跑起 OpenAI 自家模型的一条路。

以免费条款提供 gpt-oss 的服务商

本清单详列的 25 家服务商里,有 10 家至少提供一个 gpt-oss 模型。因为 OpenAI 公开的是权重而不是服务,所以 model id 在这些家之间可以完全一致,免费额度却不一样。

服务商免费形式官方公布限额信用卡匹配到的模型
GroqCloud 厂商免费额度 每分钟 30 次请求,每天 1000 次请求 不需要 openai/gpt-oss-120b、openai/gpt-oss-20b、openai/gpt-oss-safeguard-20b
SambaNova Cloud 厂商免费额度 每分钟 20 次请求,每天 20 次请求 不需要 gpt-oss-120b
Cloudflare Workers AI 厂商免费额度 以计算单位公布 不需要 @cf/openai/gpt-oss-120b
Hugging Face Inference Providers 厂商免费额度 以额度余额公布 不需要 openai/gpt-oss-120b
Fireworks AI 厂商免费额度 每分钟 10 次请求 不需要 accounts/fireworks/models/gpt-oss-120b
Ollama Cloud 厂商免费额度 有限流但未公布数值 不需要 gpt-oss:120b-cloud、gpt-oss:20b-cloud
Cerebras Inference 注册赠送额度 每分钟 5 次请求 需要 gpt-oss-120b
Vercel AI Gateway 注册赠送额度 以额度余额公布 不需要 openai/gpt-oss-120b
Together AI 按量计费 动态,无固定数值 不需要 openai/gpt-oss-120b
Scaleway Generative APIs 按量计费 有限流但未公布数值 需要 gpt-oss-120b

免费条款到底差在哪

  • GroqCloud — 免费计划的限额按模型区分,并按组织(organization)合并计算。
  • SambaNova Cloud — 只要账号没有绑定支付方式,就适用免费档。
  • Cloudflare Workers AI — Workers Free 和 Workers Paid 两种计划都含每天 10,000 Neurons 的免费额度,每天 00:00 UTC 重置。
  • Hugging Face Inference Providers — 登录的免费用户每月获得 0.10 美元的 Inference Provider 额度(Hugging Face 注明这个数额可能调整);PRO 用户 2.00 美元,Team 或 Enterprise 组织按每席位 2.00 美元。
  • Fireworks AI — 既没有绑定支付方式、也没有余额的账号,整个账号合计限 10 次请求/分钟。
  • Ollama Cloud — 云端模型跑在 Ollama 自己的服务器上,本地 CLI 的用法保持不变,只要一个 ollama.com 账号就能开始。
  • Cerebras Inference — 免费试用的限额是每个模型 5 RPM、30K TPM,并有每小时 100 万 token、每天 100 万 token 的封顶,适用于 gpt-oss-120b 和 gemma-4-31b —— zai-glm-4.7 已不在这张表里。
  • Vercel AI Gateway — 每个 Vercel team 账号都有免费档,但免费档只覆盖模型子集,不是全部目录;免费档的请求还按模型限流,上限低于付费档,而这些按模型的数字并不公布。
  • Together AI — Together 采用按模型的动态限流:持续成功的流量会把限额抬上去,流量降下来限额也跟着回落,官方明确说明不公布固定的按模型限额。
  • Scaleway Generative APIs — 通过 Generative APIs - Serverless 提供的每个模型,都同时受每分钟 token 数、每分钟查询数和并发请求数三重限制。

怎么挑一家

这 10 家里有 4 家公布了固定的请求次数,其余的只给出层级或额度余额,也就是说「到底免费多少」唯一诚实的答案在它们各自的控制台里。有 8 家不要信用卡。有 7 家会响应跨域浏览器请求,所以这些家的 key 不用装任何东西,直接在浏览器检测页里就能验。

model id 匹配上 gpt-oss,并不等于承诺免费额度里就包含它。服务商会在不改 id 的情况下把某个模型在付费和免费之间挪动,所以每一行都链回对应的服务商页面,那里放着该服务商自己的原话和读取日期。

免费额度用完之后是什么价

上面这些免费额度都有到头的一天,而 gpt-oss 到那时候是什么价,不在本清单的追踪范围内。下面是公开报道过的价钱,连着它出处的整句原话一起引——出自同一维护者整理的那张表,那里每个数都带着自己那句话:

价格它出自的那句原话对应长文
$0.19 / $5 per million tokens Chinese AI models provide a cost-effective alternative to their American counterparts, with input costs as low as $0.19 per million tokens, compared to OpenAI's $5-12. How Chinese AI Agent Tools Leverage 1.6 Billion Free Tokens

要算的那笔账不是 gpt-oss、是别的?一句话说出它的名字——只有一格要填,下一个去查的价钱按谁问了排。