按量计费 · 来源核验于 2026-08-22

Nebius Token Factory 免费额度

Nebius Token Factory 官方就免费额度公布了什么、覆盖哪些模型,以及怎么把现有工具指过去。

Nebius Token Factory 的免费额度给到哪一步

限额是动态的,文档不公布账号默认值:它让你去 Token Factory 里的 Rate Limits 页面自己看。本清单原先当作基准值的 60 RPM / 400,000 TPM,在页面上只出现在一张标着「示意」(visual example)的表里,所以这里不再把它当限额引用。真正通用的规则是:按 15 分钟滚动窗口评估用量,窗口内平均达到当前限额的 80% 及以上,下一窗口上调 20%;平均在 50% 及以下,则除以 1.5;上限是基准配额的 20 倍,再往上要走企业版。文档没有记载任何长期免费额度。

官方公布限额
动态,无固定数值
免费形式
按量计费
信用卡
不需要
协议
兼容 OpenAI,端点 https://api.tokenfactory.nebius.com/v1
生命周期
正常开放
来源核验日期
2026-08-22

超出限额的请求可能仍然会以较低优先级被处理,并带上 x-ratelimit-over-limit 响应头,而不是直接失败。

Nebius Token Factory 在这份清单里处于什么位置

本站详列的 25 家服务商里,属于按量计费的有 8 家,Nebius Token Factory 是其中之一。它不要求绑信用卡,25 家里有 23 家是这样。它没有公布固定的请求次数,25 家里有 16 家同样没有。

对比对象官方公布限额信用卡端点
Nebius Token Factory(当前页) 动态,无固定数值 不需要 api.tokenfactory.nebius.com
Perplexity API 每分钟 50 次请求 不需要 api.perplexity.ai
DeepInfra 有限流但未公布数值 不需要 api.deepinfra.com
Chutes 按付费计划公布 不需要 llm.chutes.ai

Nebius Token Factory 标为免费的模型

  • deepseek-ai/DeepSeek-V3 —— DeepSeek,本站另有 4 家服务商也免费提供
  • meta-llama/Llama-3.3-70B-Instruct —— Llama,本站另有 8 家服务商也免费提供
  • Qwen/Qwen3-235B-A22B —— 通义千问 Qwen,本站另有 9 家服务商也免费提供

本站另有 8 家服务商也以免费条款提供 Llama 系列,而且条款并不相同:SambaNova Cloud、Cloudflare Workers AI、Fireworks AI、Novita AI、IBM watsonx.ai、Together AI、DeepInfra、Scaleway Generative APIs。本站另有 9 家服务商也以免费条款提供 通义千问 Qwen 系列,而且条款并不相同:GroqCloud、Cloudflare Workers AI、SiliconFlow、Alibaba Cloud Model Studio、Ollama Cloud、Together AI、DeepInfra、Chutes、Scaleway Generative APIs。本站另有 4 家服务商也以免费条款提供 DeepSeek 系列,而且条款并不相同:SambaNova Cloud、Hugging Face Inference Providers、SiliconFlow、DeepInfra。

怎么验一个 Nebius Token Factory 的 key

CORS 预检允许任意源携带 Authorization 请求头,所以浏览器可以直接调用这个端点。这一结论是 2026-07-25 针对 https://api.tokenfactory.nebius.com 实测得到的。

所以不用装任何东西,直接在浏览器检测页里就能验。如果你不愿意把 key 粘进网页,下面这条命令是等价的:

#!/usr/bin/env sh
set -eu

: "${NEBIUS_API_KEY:?Set NEBIUS_API_KEY to a key you created yourself at the provider console}"

# Prints the models this key can reach, then the HTTP status on its own line so
# 200, 401, and 429 stay distinguishable.
curl --silent --show-error \
  --write-out '\nHTTP %{http_code}\n' \
  --header "Authorization: Bearer $NEBIUS_API_KEY" \
  'https://api.tokenfactory.nebius.com/v1/models'

怎么用一个 Nebius Token Factory 的 key

Nebius Token Factory 在 https://api.tokenfactory.nebius.com/v1 上提供 OpenAI chat completions 协议。把任何支持自定义 base URL 的客户端指过去,并让客户端从 NEBIUS_API_KEY 读取 key,这样 key 本身永远不会落进配置文件:

# Merge this snippet into ~/.codex/config.toml.
# Project-level config cannot select a custom model provider.
model = "deepseek-ai/DeepSeek-V3"
model_provider = "nebius"

[model_providers.nebius]
name = "Nebius Token Factory OpenAI-compatible gateway"
base_url = "https://api.tokenfactory.nebius.com/v1"
env_key = "NEBIUS_API_KEY"
wire_api = "responses"

关于 Nebius Token Factory 免费额度的常见问题

Nebius Token Factory 需要绑信用卡吗?

不需要。本站有 23 家不用绑卡就能拿到免费访问,Nebius Token Factory 是其中之一,所以试一下的成本只有注册本身。

Nebius Token Factory 免费额度的限流是多少?

Nebius Token Factory 没有公布单一的免费额度数字:它的限额形式是「动态,无固定数值」。本清单在这里留空,而不是猜一个数。

Nebius Token Factory 的 key 撞到限额会怎样?

端点返回 429。这只说明那一次请求被拒了,不说明还剩多少额度;只有服务商返回的 reset 响应头才能告诉你什么时候恢复。

Nebius Token Factory 的免费额度会取消吗?

截至 2026-08-22,Nebius Token Factory 自己的文档里没有这样的说法。超出限额的请求可能仍然会以较低优先级被处理,并带上 x-ratelimit-over-limit 响应头,而不是直接失败。

Nebius Token Factory 能配合 Codex、Cline 或 Continue 使用吗?

可以。Nebius Token Factory 在 https://api.tokenfactory.nebius.com/v1 上提供 OpenAI chat completions 协议,任何支持自定义 base URL 的客户端都能用。例外是 Claude Code,它讲的是 Anthropic 协议。

官方来源

以上每个数字都是 2026-08-22 从这些页面上读到的。如果某家只在控制台里给出限额,本清单就如实记下这件事,而不是填一个数字。收录标准和纠错流程见数据方法。