Together AI 的免费额度给到哪一步
Together 采用按模型的动态限流:持续成功的流量会把限额抬上去,流量降下来限额也跟着回落,官方明确说明不公布固定的按模型限额。超过动态速率的请求返回 429 并带 x-ratelimit-reset;在限额之内却仍然失败的请求返回 503。限流页面上没有记录任何常设的免费额度。
- 官方公布限额
- 动态,无固定数值
- 免费形式
- 按量计费
- 信用卡
- 不需要
- 协议
- 兼容 OpenAI,端点
https://api.together.xyz/v1 - 生命周期
- 正常开放
- 来源核验日期
- 2026-07-25
因为限额是从用量推导出来的,新账号无法事先知道自己的上限;改读 429 的响应头才是办法。
Together AI 在这份清单里处于什么位置
本站详列的 25 家服务商里,属于按量计费的有 6 家,Together AI 是其中之一。它不要求绑信用卡,25 家里有 23 家是这样。它没有公布固定的请求次数,25 家里有 16 家同样没有。
| 对比对象 | 官方公布限额 | 信用卡 | 端点 |
|---|---|---|---|
| Together AI(当前页) | 动态,无固定数值 | 不需要 | api.together.xyz |
| Nebius Token Factory | 每分钟 60 次请求 | 不需要 | api.tokenfactory.nebius.com |
| Perplexity API | 每分钟 50 次请求 | 不需要 | api.perplexity.ai |
| DeepInfra | 有限流但未公布数值 | 不需要 | api.deepinfra.com |
Together AI 标为免费的模型
meta-llama/Llama-3.3-70B-Instruct-Turbo—— Llama,本站另有 8 家服务商也免费提供openai/gpt-oss-120b—— gpt-oss,本站另有 9 家服务商也免费提供Qwen/Qwen3-Coder-480B-A35B-Instruct-Turbo—— 通义千问 Qwen,本站另有 8 家服务商也免费提供
本站另有 9 家服务商也以免费条款提供 gpt-oss 系列,而且条款并不相同:GroqCloud、SambaNova Cloud、Cloudflare Workers AI、Hugging Face Inference Providers、Fireworks AI、Ollama Cloud、Cerebras Inference、Vercel AI Gateway、Scaleway Generative APIs。本站另有 8 家服务商也以免费条款提供 Llama 系列,而且条款并不相同:GroqCloud、SambaNova Cloud、Cloudflare Workers AI、Fireworks AI、IBM watsonx.ai、Nebius Token Factory、DeepInfra、Scaleway Generative APIs。本站另有 8 家服务商也以免费条款提供 通义千问 Qwen 系列,而且条款并不相同:Cloudflare Workers AI、SiliconFlow、Alibaba Cloud Model Studio、Ollama Cloud、Nebius Token Factory、DeepInfra、Chutes、Scaleway Generative APIs。
怎么验一个 Together AI 的 key
CORS 预检允许任意源携带 Authorization 请求头,所以浏览器可以直接调用这个端点。这一结论是 2026-07-25 针对 https://api.together.xyz 实测得到的。
所以不用装任何东西,直接在浏览器检测页里就能验。如果你不愿意把 key 粘进网页,下面这条命令是等价的:
#!/usr/bin/env sh
set -eu
: "${TOGETHER_API_KEY:?Set TOGETHER_API_KEY to a key you created yourself at the provider console}"
# Prints the models this key can reach, then the HTTP status on its own line so
# 200, 401, and 429 stay distinguishable.
curl --silent --show-error \
--write-out '\nHTTP %{http_code}\n' \
--header "Authorization: Bearer $TOGETHER_API_KEY" \
'https://api.together.xyz/v1/models'
怎么用一个 Together AI 的 key
Together AI 在 https://api.together.xyz/v1 上提供 OpenAI chat completions 协议。把任何支持自定义 base URL 的客户端指过去,并让客户端从 TOGETHER_API_KEY 读取 key,这样 key 本身永远不会落进配置文件:
# Merge this snippet into ~/.codex/config.toml.
# Project-level config cannot select a custom model provider.
model = "meta-llama/Llama-3.3-70B-Instruct-Turbo"
model_provider = "together"
[model_providers.together]
name = "Together AI OpenAI-compatible gateway"
base_url = "https://api.together.xyz/v1"
env_key = "TOGETHER_API_KEY"
wire_api = "responses"
关于 Together AI 免费额度的常见问题
Together AI 需要绑信用卡吗?
不需要。本站有 23 家不用绑卡就能拿到免费访问,Together AI 是其中之一,所以试一下的成本只有注册本身。
Together AI 免费额度的限流是多少?
Together AI 没有公布单一的免费额度数字:它的限额形式是「动态,无固定数值」。本清单在这里留空,而不是猜一个数。
Together AI 的 key 撞到限额会怎样?
端点返回 429。这只说明那一次请求被拒了,不说明还剩多少额度;只有服务商返回的 reset 响应头才能告诉你什么时候恢复。
Together AI 的免费额度会取消吗?
截至 2026-07-25,Together AI 自己的文档里没有这样的说法。因为限额是从用量推导出来的,新账号无法事先知道自己的上限;改读 429 的响应头才是办法。
Together AI 能配合 Codex、Cline 或 Continue 使用吗?
可以。Together AI 在 https://api.together.xyz/v1 上提供 OpenAI chat completions 协议,任何支持自定义 base URL 的客户端都能用。例外是 Claude Code,它讲的是 Anthropic 协议。
官方来源
- Together serverless rate limitshttps://docs.together.ai/docs/serverless/rate-limits
- Together OpenAI compatibilityhttps://docs.together.ai/docs/openai-api-compatibility
- Together pricinghttps://www.together.ai/pricing
以上每个数字都是 2026-07-25 从这些页面上读到的。如果某家只在控制台里给出限额,本清单就如实记下这件事,而不是填一个数字。收录标准和纠错流程见数据方法。