Fireworks AI 的免费额度给到哪一步
既没有绑定支付方式、也没有余额的账号,整个账号合计限 10 次请求/分钟。绑定支付方式并有可用余额后,上限最高能到 6,000 RPM。Fireworks 是预付费模式,所以 10 RPM 这个区间是唯一的零成本路径,官方也没有为它公布每日请求上限。
- 官方公布限额
- 每分钟 10 次请求
- 免费形式
- 厂商免费额度
- 信用卡
- 不需要
- 协议
- 兼容 OpenAI,端点
https://api.fireworks.ai/inference/v1 - 生命周期
- 正常开放
- 来源核验日期
- 2026-07-25
10 RPM 是请求速率的封顶,不是一份免费 token 赠额;serverless 的 token 吞吐仍然取决于你的消费层级。
Fireworks AI 在这份清单里处于什么位置
本站详列的 25 家服务商里,属于厂商免费额度的有 15 家,Fireworks AI 是其中之一。它不要求绑信用卡,25 家里有 23 家是这样。它公布了固定数值——每分钟 10 次请求——25 家里只有 9 家做到了这一点。
| 对比对象 | 官方公布限额 | 信用卡 | 端点 |
|---|---|---|---|
| Fireworks AI(当前页) | 每分钟 10 次请求 | 不需要 | api.fireworks.ai |
| Z.AI Open Platform | 部分模型标价为零 | 不需要 | api.z.ai |
| Novita AI | 部分模型标价为零 | 不需要 | api.novita.ai |
| Mistral La Plateforme | 有限流但未公布数值 | 不需要 | api.mistral.ai |
Fireworks AI 标为免费的模型
accounts/fireworks/models/llama-v3p3-70b-instruct—— Llama,本站另有 8 家服务商也免费提供accounts/fireworks/models/gpt-oss-120b—— gpt-oss,本站另有 9 家服务商也免费提供
本站另有 9 家服务商也以免费条款提供 gpt-oss 系列,而且条款并不相同:GroqCloud、SambaNova Cloud、Cloudflare Workers AI、Hugging Face Inference Providers、Ollama Cloud、Cerebras Inference、Vercel AI Gateway、Together AI、Scaleway Generative APIs。本站另有 8 家服务商也以免费条款提供 Llama 系列,而且条款并不相同:GroqCloud、SambaNova Cloud、Cloudflare Workers AI、IBM watsonx.ai、Together AI、Nebius Token Factory、DeepInfra、Scaleway Generative APIs。
怎么验一个 Fireworks AI 的 key
CORS 预检允许任意源携带 Authorization 请求头,所以浏览器可以直接调用这个端点。这一结论是 2026-07-25 针对 https://api.fireworks.ai 实测得到的。
所以不用装任何东西,直接在浏览器检测页里就能验。如果你不愿意把 key 粘进网页,下面这条命令是等价的:
#!/usr/bin/env sh
set -eu
: "${FIREWORKS_API_KEY:?Set FIREWORKS_API_KEY to a key you created yourself at the provider console}"
# Prints the models this key can reach, then the HTTP status on its own line so
# 200, 401, and 429 stay distinguishable.
curl --silent --show-error \
--write-out '\nHTTP %{http_code}\n' \
--header "Authorization: Bearer $FIREWORKS_API_KEY" \
'https://api.fireworks.ai/inference/v1/models'
怎么用一个 Fireworks AI 的 key
Fireworks AI 在 https://api.fireworks.ai/inference/v1 上提供 OpenAI chat completions 协议。把任何支持自定义 base URL 的客户端指过去,并让客户端从 FIREWORKS_API_KEY 读取 key,这样 key 本身永远不会落进配置文件:
# Merge this snippet into ~/.codex/config.toml.
# Project-level config cannot select a custom model provider.
model = "accounts/fireworks/models/llama-v3p3-70b-instruct"
model_provider = "fireworks"
[model_providers.fireworks]
name = "Fireworks AI OpenAI-compatible gateway"
base_url = "https://api.fireworks.ai/inference/v1"
env_key = "FIREWORKS_API_KEY"
wire_api = "responses"
关于 Fireworks AI 免费额度的常见问题
Fireworks AI 需要绑信用卡吗?
不需要。本站有 23 家不用绑卡就能拿到免费访问,Fireworks AI 是其中之一,所以试一下的成本只有注册本身。
Fireworks AI 免费额度的限流是多少?
Fireworks AI 公布的是每分钟 10 次请求。这些数字来自它自己的文档,核验日期为 2026-07-25。
Fireworks AI 的 key 撞到限额会怎样?
端点返回 429。这只说明那一次请求被拒了,不说明还剩多少额度;只有服务商返回的 reset 响应头才能告诉你什么时候恢复。
Fireworks AI 的免费额度会取消吗?
截至 2026-07-25,Fireworks AI 自己的文档里没有这样的说法。10 RPM 是请求速率的封顶,不是一份免费 token 赠额;serverless 的 token 吞吐仍然取决于你的消费层级。
Fireworks AI 能配合 Codex、Cline 或 Continue 使用吗?
可以。Fireworks AI 在 https://api.fireworks.ai/inference/v1 上提供 OpenAI chat completions 协议,任何支持自定义 base URL 的客户端都能用。例外是 Claude Code,它讲的是 Anthropic 协议。
官方来源
- Fireworks account quotashttps://docs.fireworks.ai/guides/quotas_usage/account-quotas
- Fireworks serverless rate limitshttps://docs.fireworks.ai/guides/quotas_usage/rate-limits
- Fireworks pricinghttps://fireworks.ai/pricing
以上每个数字都是 2026-07-25 从这些页面上读到的。如果某家只在控制台里给出限额,本清单就如实记下这件事,而不是填一个数字。收录标准和纠错流程见数据方法。