Continue 需要什么
Continue 读取一个 YAML 助手配置文件,把兼容 OpenAI 的端点当成一等公民,key 则从它自己的 secret 存储里解析。
models:下的每一项都需要provider: openai、一个提供/chat/completions的apiBase,以及服务商那边确切的modelid。apiKey用${{ secrets.NAME }}这种写法,这样文件可以提交进仓库,而值留在外面。roles决定这个模型出现在哪些场景。小的免费模型通常做chat没问题、做apply不可靠;给它配一个扛不住的 role,表现是编辑结果乱掉,而不是 API 报错。- 以
@开头的 model id(例如 Cloudflare 的)必须加引号,因为 YAML 保留了这个字符。
这条命令会生成什么文件
运行 npx free-llm-api setup continue 会写出 config.yaml。它由清单生成,所以 base URL 和 model id 都是服务商文档里的原值,不用你再去翻。下面是按 GroqCloud 填好的样子:
name: GroqCloud Free LLM
version: 0.1.0
schema: v1
models:
- name: GroqCloud llama-3.3-70b-versatile
provider: openai
model: llama-3.3-70b-versatile
apiBase: https://api.groq.com/openai/v1
apiKey: ${{ secrets.GROQ_API_KEY }}
roles:
- chat
- edit
- apply
那个文件里没有 key。值在运行时从 GROQ_API_KEY 读取——就这一个习惯,从结构上保证凭据进不了仓库。
哪些免费额度适合 Continue
本站有 22 家既提供 OpenAI 协议又不要信用卡,配 Continue 最值得先试。完整名单(含要求绑卡的那些)在清单页。
| 服务商 | Base URL | 官方公布限额 |
|---|---|---|
| Google Gemini API | https://generativelanguage.googleapis.com/v1beta/openai/ |
按项目层级设定 |
| GroqCloud | https://api.groq.com/openai/v1 |
每分钟 30 次请求,每天 1000 次请求 |
| SambaNova Cloud | https://api.sambanova.ai/v1 |
每分钟 20 次请求,每天 20 次请求 |
| Cohere | https://api.cohere.ai/compatibility/v1 |
每分钟 20 次请求 |
| Cloudflare Workers AI | https://api.cloudflare.com/client/v4/accounts/ACCOUNT_ID/ai/v1 |
以计算单位公布 |
| Hugging Face Inference Providers | https://router.huggingface.co/v1 |
以额度余额公布 |
| SiliconFlow | https://api.siliconflow.com/v1 |
每分钟 1000 次请求 |
| Fireworks AI | https://api.fireworks.ai/inference/v1 |
每分钟 10 次请求 |
用免费额度该有什么预期
Continue 会持续携带已打开文件的上下文,所以请求体积是随会话增长的,而不是随你输入的字数增长。每日 token 上限会比每日请求上限先卡住你。
在怪客户端之前,先验 key 本身:浏览器检测页能把「凭据被拒」「被限流」和「端点根本没起来」这三种情况分开,而它们的解法各不相同。
来源
这里引用的服务商数字,都来自各家自己的文档,核验日期 2026-07-25。哪些内容会被记录、哪些是有意留空的,见数据方法。