Nebius Token Factory 的免费额度给到哪一步
限额是动态的,文档不公布账号默认值:它让你去 Token Factory 里的 Rate Limits 页面自己看。本清单原先当作基准值的 60 RPM / 400,000 TPM,在页面上只出现在一张标着「示意」(visual example)的表里,所以这里不再把它当限额引用。真正通用的规则是:按 15 分钟滚动窗口评估用量,窗口内平均达到当前限额的 80% 及以上,下一窗口上调 20%;平均在 50% 及以下,则除以 1.5;上限是基准配额的 20 倍,再往上要走企业版。文档没有记载任何长期免费额度。
- 官方公布限额
- 动态,无固定数值
- 免费形式
- 按量计费
- 信用卡
- 不需要
- 协议
- 兼容 OpenAI,端点
https://api.tokenfactory.nebius.com/v1 - 生命周期
- 正常开放
- 来源核验日期
- 2026-08-22
超出限额的请求可能仍然会以较低优先级被处理,并带上 x-ratelimit-over-limit 响应头,而不是直接失败。
Nebius Token Factory 在这份清单里处于什么位置
本站详列的 25 家服务商里,属于按量计费的有 8 家,Nebius Token Factory 是其中之一。它不要求绑信用卡,25 家里有 23 家是这样。它没有公布固定的请求次数,25 家里有 16 家同样没有。
| 对比对象 | 官方公布限额 | 信用卡 | 端点 |
|---|---|---|---|
| Nebius Token Factory(当前页) | 动态,无固定数值 | 不需要 | api.tokenfactory.nebius.com |
| Perplexity API | 每分钟 50 次请求 | 不需要 | api.perplexity.ai |
| DeepInfra | 有限流但未公布数值 | 不需要 | api.deepinfra.com |
| Chutes | 按付费计划公布 | 不需要 | llm.chutes.ai |
Nebius Token Factory 标为免费的模型
deepseek-ai/DeepSeek-V3—— DeepSeek,本站另有 4 家服务商也免费提供meta-llama/Llama-3.3-70B-Instruct—— Llama,本站另有 8 家服务商也免费提供Qwen/Qwen3-235B-A22B—— 通义千问 Qwen,本站另有 9 家服务商也免费提供
本站另有 8 家服务商也以免费条款提供 Llama 系列,而且条款并不相同:SambaNova Cloud、Cloudflare Workers AI、Fireworks AI、Novita AI、IBM watsonx.ai、Together AI、DeepInfra、Scaleway Generative APIs。本站另有 9 家服务商也以免费条款提供 通义千问 Qwen 系列,而且条款并不相同:GroqCloud、Cloudflare Workers AI、SiliconFlow、Alibaba Cloud Model Studio、Ollama Cloud、Together AI、DeepInfra、Chutes、Scaleway Generative APIs。本站另有 4 家服务商也以免费条款提供 DeepSeek 系列,而且条款并不相同:SambaNova Cloud、Hugging Face Inference Providers、SiliconFlow、DeepInfra。
怎么验一个 Nebius Token Factory 的 key
CORS 预检允许任意源携带 Authorization 请求头,所以浏览器可以直接调用这个端点。这一结论是 2026-07-25 针对 https://api.tokenfactory.nebius.com 实测得到的。
所以不用装任何东西,直接在浏览器检测页里就能验。如果你不愿意把 key 粘进网页,下面这条命令是等价的:
#!/usr/bin/env sh
set -eu
: "${NEBIUS_API_KEY:?Set NEBIUS_API_KEY to a key you created yourself at the provider console}"
# Prints the models this key can reach, then the HTTP status on its own line so
# 200, 401, and 429 stay distinguishable.
curl --silent --show-error \
--write-out '\nHTTP %{http_code}\n' \
--header "Authorization: Bearer $NEBIUS_API_KEY" \
'https://api.tokenfactory.nebius.com/v1/models'
怎么用一个 Nebius Token Factory 的 key
Nebius Token Factory 在 https://api.tokenfactory.nebius.com/v1 上提供 OpenAI chat completions 协议。把任何支持自定义 base URL 的客户端指过去,并让客户端从 NEBIUS_API_KEY 读取 key,这样 key 本身永远不会落进配置文件:
# Merge this snippet into ~/.codex/config.toml.
# Project-level config cannot select a custom model provider.
model = "deepseek-ai/DeepSeek-V3"
model_provider = "nebius"
[model_providers.nebius]
name = "Nebius Token Factory OpenAI-compatible gateway"
base_url = "https://api.tokenfactory.nebius.com/v1"
env_key = "NEBIUS_API_KEY"
wire_api = "responses"
关于 Nebius Token Factory 免费额度的常见问题
Nebius Token Factory 需要绑信用卡吗?
不需要。本站有 23 家不用绑卡就能拿到免费访问,Nebius Token Factory 是其中之一,所以试一下的成本只有注册本身。
Nebius Token Factory 免费额度的限流是多少?
Nebius Token Factory 没有公布单一的免费额度数字:它的限额形式是「动态,无固定数值」。本清单在这里留空,而不是猜一个数。
Nebius Token Factory 的 key 撞到限额会怎样?
端点返回 429。这只说明那一次请求被拒了,不说明还剩多少额度;只有服务商返回的 reset 响应头才能告诉你什么时候恢复。
Nebius Token Factory 的免费额度会取消吗?
截至 2026-08-22,Nebius Token Factory 自己的文档里没有这样的说法。超出限额的请求可能仍然会以较低优先级被处理,并带上 x-ratelimit-over-limit 响应头,而不是直接失败。
Nebius Token Factory 能配合 Codex、Cline 或 Continue 使用吗?
可以。Nebius Token Factory 在 https://api.tokenfactory.nebius.com/v1 上提供 OpenAI chat completions 协议,任何支持自定义 base URL 的客户端都能用。例外是 Claude Code,它讲的是 Anthropic 协议。
官方来源
- Nebius rate limits and scalinghttps://docs.tokenfactory.nebius.com/ai-models-inference/rate-limits
- Nebius Token Factory quickstarthttps://docs.tokenfactory.nebius.com/quickstart
- Nebius billing and consumptionhttps://docs.tokenfactory.nebius.com/other-capabilities/billing-new
以上每个数字都是 2026-08-22 从这些页面上读到的。如果某家只在控制台里给出限额,本清单就如实记下这件事,而不是填一个数字。收录标准和纠错流程见数据方法。