通义千问 Qwen 系列是什么
阿里的 Qwen 系列同时覆盖通用对话与代码变体,也是中国大陆服务商提供得最稳定的一个系列。
以免费条款提供 通义千问 Qwen 的服务商
本清单详列的 25 家服务商里,有 9 家至少提供一个 通义千问 Qwen 模型。因为 Alibaba 公开的是权重而不是服务,所以 model id 在这些家之间可以完全一致,免费额度却不一样。
| 服务商 | 免费形式 | 官方公布限额 | 信用卡 | 匹配到的模型 |
|---|---|---|---|---|
| Cloudflare Workers AI | 厂商免费额度 | 以计算单位公布 | 不需要 | @cf/qwen/qwen2.5-coder-32b-instruct |
| SiliconFlow | 厂商免费额度 | 每分钟 1000 次请求 | 不需要 | Qwen/Qwen3-8B |
| Alibaba Cloud Model Studio | 厂商免费额度 | 按模型公布 | 不需要 | qwen-plus、qwen-turbo、qwen3-coder-plus |
| Ollama Cloud | 厂商免费额度 | 有限流但未公布数值 | 不需要 | qwen3-coder:480b-cloud |
| Together AI | 按量计费 | 动态,无固定数值 | 不需要 | Qwen/Qwen3-Coder-480B-A35B-Instruct-Turbo |
| Nebius Token Factory | 按量计费 | 每分钟 60 次请求 | 不需要 | Qwen/Qwen3-235B-A22B |
| DeepInfra | 按量计费 | 有限流但未公布数值 | 不需要 | Qwen/Qwen3-Next-80B-A3B-Instruct |
| Chutes | 按量计费 | 按付费计划公布 | 不需要 | Qwen/Qwen3-32B |
| Scaleway Generative APIs | 按量计费 | 有限流但未公布数值 | 需要 | qwen3-coder-30b-a3b-instruct |
免费条款到底差在哪
- Cloudflare Workers AI — Workers Free 和 Workers Paid 两个计划都包含每天 10,000 Neurons 的免费额度,每天 UTC 00:00 重置。
- SiliconFlow — 免费模型的限流是固定值;付费模型按月消费分层,L0 起步为 1,000 RPM、40,000 TPM。
- Alibaba Cloud Model Studio — 限流在阿里云主账号这一层生效,会把该账号下所有 RAM 用户、工作空间和 API key 的用量合并计算。
- Ollama Cloud — 云端模型跑在 Ollama 自己的服务器上,本地 CLI 的用法保持不变,只要一个 ollama.com 账号就能开始。
- Together AI — Together 采用按模型的动态限流:持续成功的流量会把限额抬上去,流量降下来限额也跟着回落,官方明确说明不公布固定的按模型限额。
- Nebius Token Factory — 限额是动态的,公布的基线为 60 RPM 和 400,000 TPM。
- DeepInfra — 官方定价页为每个在服模型列出了每百万 token 的输入与输出价格,既没有描述免费额度,也没有公布请求速率限制。
- Chutes — Chutes 按 token 计费,并出售包含每日额度的订阅计划:Plus 每月 10 美元,含一份每日额度,超出部分在按量价上打 94 折;Pro 每月 20 美元,每日额度更大,超出部分打 9 折。
- Scaleway Generative APIs — 通过 Generative APIs - Serverless 提供的每个模型,都同时受每分钟 token 数、每分钟查询数和并发请求数三重限制。
怎么挑一家
这 9 家里有 2 家公布了固定的请求次数,其余的只给出层级或额度余额,也就是说「到底免费多少」唯一诚实的答案在它们各自的控制台里。有 8 家不要信用卡。有 7 家会响应跨域浏览器请求,所以这些家的 key 不用装任何东西,直接在浏览器检测页里就能验。
model id 匹配上 通义千问 Qwen,并不等于承诺免费额度里就包含它。服务商会在不改 id 的情况下把某个模型在付费和免费之间挪动,所以每一行都链回对应的服务商页面,那里放着该服务商自己的原话和读取日期。