Nebius Token Factory 的免费额度给到哪一步
限额是动态的,公布的基线为 60 RPM 和 400,000 TPM。用量按 15 分钟滚动窗口评估:窗口内平均达到或超过当前限额的 80%,下一个窗口上调 20%;平均低于或等于 50% 则除以 1.5;上限是基础配额的 20 倍,再往上要走 Enterprise 计划。该页面没有记录任何常设的免费额度。
- 官方公布限额
- 每分钟 60 次请求
- 免费形式
- 按量计费
- 信用卡
- 不需要
- 协议
- 兼容 OpenAI,端点
https://api.tokenfactory.nebius.com/v1 - 生命周期
- 正常开放
- 来源核验日期
- 2026-07-25
超出限额的请求可能仍然会以较低优先级被处理,并带上 x-ratelimit-over-limit 响应头,而不是直接失败。
Nebius Token Factory 在这份清单里处于什么位置
本站详列的 25 家服务商里,属于按量计费的有 6 家,Nebius Token Factory 是其中之一。它不要求绑信用卡,25 家里有 23 家是这样。它公布了固定数值——每分钟 60 次请求——25 家里只有 9 家做到了这一点。
| 对比对象 | 官方公布限额 | 信用卡 | 端点 |
|---|---|---|---|
| Nebius Token Factory(当前页) | 每分钟 60 次请求 | 不需要 | api.tokenfactory.nebius.com |
| Perplexity API | 每分钟 50 次请求 | 不需要 | api.perplexity.ai |
| DeepInfra | 有限流但未公布数值 | 不需要 | api.deepinfra.com |
| Chutes | 按付费计划公布 | 不需要 | llm.chutes.ai |
Nebius Token Factory 标为免费的模型
deepseek-ai/DeepSeek-V3—— DeepSeek,本站另有 4 家服务商也免费提供meta-llama/Llama-3.3-70B-Instruct—— Llama,本站另有 8 家服务商也免费提供Qwen/Qwen3-235B-A22B—— 通义千问 Qwen,本站另有 8 家服务商也免费提供
本站另有 8 家服务商也以免费条款提供 Llama 系列,而且条款并不相同:GroqCloud、SambaNova Cloud、Cloudflare Workers AI、Fireworks AI、IBM watsonx.ai、Together AI、DeepInfra、Scaleway Generative APIs。本站另有 8 家服务商也以免费条款提供 通义千问 Qwen 系列,而且条款并不相同:Cloudflare Workers AI、SiliconFlow、Alibaba Cloud Model Studio、Ollama Cloud、Together AI、DeepInfra、Chutes、Scaleway Generative APIs。本站另有 4 家服务商也以免费条款提供 DeepSeek 系列,而且条款并不相同:SambaNova Cloud、Hugging Face Inference Providers、SiliconFlow、DeepInfra。
怎么验一个 Nebius Token Factory 的 key
CORS 预检允许任意源携带 Authorization 请求头,所以浏览器可以直接调用这个端点。这一结论是 2026-07-25 针对 https://api.tokenfactory.nebius.com 实测得到的。
所以不用装任何东西,直接在浏览器检测页里就能验。如果你不愿意把 key 粘进网页,下面这条命令是等价的:
#!/usr/bin/env sh
set -eu
: "${NEBIUS_API_KEY:?Set NEBIUS_API_KEY to a key you created yourself at the provider console}"
# Prints the models this key can reach, then the HTTP status on its own line so
# 200, 401, and 429 stay distinguishable.
curl --silent --show-error \
--write-out '\nHTTP %{http_code}\n' \
--header "Authorization: Bearer $NEBIUS_API_KEY" \
'https://api.tokenfactory.nebius.com/v1/models'
怎么用一个 Nebius Token Factory 的 key
Nebius Token Factory 在 https://api.tokenfactory.nebius.com/v1 上提供 OpenAI chat completions 协议。把任何支持自定义 base URL 的客户端指过去,并让客户端从 NEBIUS_API_KEY 读取 key,这样 key 本身永远不会落进配置文件:
# Merge this snippet into ~/.codex/config.toml.
# Project-level config cannot select a custom model provider.
model = "deepseek-ai/DeepSeek-V3"
model_provider = "nebius"
[model_providers.nebius]
name = "Nebius Token Factory OpenAI-compatible gateway"
base_url = "https://api.tokenfactory.nebius.com/v1"
env_key = "NEBIUS_API_KEY"
wire_api = "responses"
关于 Nebius Token Factory 免费额度的常见问题
Nebius Token Factory 需要绑信用卡吗?
不需要。本站有 23 家不用绑卡就能拿到免费访问,Nebius Token Factory 是其中之一,所以试一下的成本只有注册本身。
Nebius Token Factory 免费额度的限流是多少?
Nebius Token Factory 公布的是每分钟 60 次请求。这些数字来自它自己的文档,核验日期为 2026-07-25。
Nebius Token Factory 的 key 撞到限额会怎样?
端点返回 429。这只说明那一次请求被拒了,不说明还剩多少额度;只有服务商返回的 reset 响应头才能告诉你什么时候恢复。
Nebius Token Factory 的免费额度会取消吗?
截至 2026-07-25,Nebius Token Factory 自己的文档里没有这样的说法。超出限额的请求可能仍然会以较低优先级被处理,并带上 x-ratelimit-over-limit 响应头,而不是直接失败。
Nebius Token Factory 能配合 Codex、Cline 或 Continue 使用吗?
可以。Nebius Token Factory 在 https://api.tokenfactory.nebius.com/v1 上提供 OpenAI chat completions 协议,任何支持自定义 base URL 的客户端都能用。例外是 Claude Code,它讲的是 Anthropic 协议。
官方来源
- Nebius rate limits and scalinghttps://docs.tokenfactory.nebius.com/ai-models-inference/rate-limits
- Nebius Token Factory quickstarthttps://docs.tokenfactory.nebius.com/quickstart
- Nebius billing and consumptionhttps://docs.tokenfactory.nebius.com/other-capabilities/billing-new
以上每个数字都是 2026-07-25 从这些页面上读到的。如果某家只在控制台里给出限额,本清单就如实记下这件事,而不是填一个数字。收录标准和纠错流程见数据方法。