Alibaba · 本清单收录 10 家

通义千问 Qwen 免费 API 访问

本清单里所有以免费条款提供 通义千问 Qwen 模型的服务商,以及各自公布的限额。

通义千问 Qwen 系列是什么

阿里的 Qwen 系列同时覆盖通用对话与代码变体,也是中国大陆服务商提供得最稳定的一个系列。

以免费条款提供 通义千问 Qwen 的服务商

本清单详列的 25 家服务商里,有 10 家至少提供一个 通义千问 Qwen 模型。因为 Alibaba 公开的是权重而不是服务,所以 model id 在这些家之间可以完全一致,免费额度却不一样。

服务商免费形式官方公布限额信用卡匹配到的模型
GroqCloud 厂商免费额度 每分钟 30 次请求,每天 1000 次请求 不需要 qwen/qwen3.6-27b
Cloudflare Workers AI 厂商免费额度 以计算单位公布 不需要 @cf/qwen/qwen2.5-coder-32b-instruct
SiliconFlow 厂商免费额度 每分钟 1000 次请求 不需要 Qwen/Qwen3-8B
Alibaba Cloud Model Studio 厂商免费额度 按模型公布 不需要 qwen-plus、qwen-turbo、qwen3-coder-plus
Ollama Cloud 厂商免费额度 有限流但未公布数值 不需要 qwen3-coder:480b-cloud
Together AI 按量计费 动态,无固定数值 不需要 Qwen/Qwen3-Coder-480B-A35B-Instruct-Turbo
Nebius Token Factory 按量计费 动态,无固定数值 不需要 Qwen/Qwen3-235B-A22B
DeepInfra 按量计费 有限流但未公布数值 不需要 Qwen/Qwen3-Next-80B-A3B-Instruct
Chutes 按量计费 按付费计划公布 不需要 Qwen/Qwen3-32B
Scaleway Generative APIs 按量计费 有限流但未公布数值 需要 qwen3-coder-30b-a3b-instruct

免费条款到底差在哪

  • GroqCloud — 免费计划的限额按模型区分,并按组织(organization)合并计算。
  • Cloudflare Workers AI — Workers Free 和 Workers Paid 两种计划都含每天 10,000 Neurons 的免费额度,每天 00:00 UTC 重置。
  • SiliconFlow — 免费模型的限流是固定值;付费模型按月消费分层,L0 起步为 1,000 RPM、40,000 TPM。
  • Alibaba Cloud Model Studio — 限流在阿里云主账号这一层生效,会把该账号下所有 RAM 用户、工作空间和 API key 的用量合并计算。
  • Ollama Cloud — 云端模型跑在 Ollama 自己的服务器上,本地 CLI 的用法保持不变,只要一个 ollama.com 账号就能开始。
  • Together AI — Together 采用按模型的动态限流:持续成功的流量会把限额抬上去,流量降下来限额也跟着回落,官方明确说明不公布固定的按模型限额。
  • Nebius Token Factory — 限额是动态的,文档不公布账号默认值:它让你去 Token Factory 里的 Rate Limits 页面自己看。
  • DeepInfra — 官方定价页为每个在服模型列出了每百万 token 的输入与输出价格,既没有描述免费额度,也没有公布请求速率限制。
  • Chutes — Chutes 按 token 计费,并出售包含每日额度的订阅计划:Plus 每月 10 美元,含一份每日额度,超出部分在按量价上打 94 折;Pro 每月 20 美元,每日额度更大,超出部分打 9 折。
  • Scaleway Generative APIs — 通过 Generative APIs - Serverless 提供的每个模型,都同时受每分钟 token 数、每分钟查询数和并发请求数三重限制。

怎么挑一家

这 10 家里有 2 家公布了固定的请求次数,其余的只给出层级或额度余额,也就是说「到底免费多少」唯一诚实的答案在它们各自的控制台里。有 9 家不要信用卡。有 8 家会响应跨域浏览器请求,所以这些家的 key 不用装任何东西,直接在浏览器检测页里就能验。

model id 匹配上 通义千问 Qwen,并不等于承诺免费额度里就包含它。服务商会在不改 id 的情况下把某个模型在付费和免费之间挪动,所以每一行都链回对应的服务商页面,那里放着该服务商自己的原话和读取日期。