客户端接入 · 清单核验于 2026-07-25

Continue 搭配免费 LLM API

Continue 需要的配置由清单直接生成,另附真正能配合它工作的免费额度。

Continue 需要什么

Continue 读取一个 YAML 助手配置文件,把兼容 OpenAI 的端点当成一等公民,key 则从它自己的 secret 存储里解析。

  1. models: 下的每一项都需要 provider: openai、一个提供 /chat/completionsapiBase,以及服务商那边确切的 model id。
  2. apiKey${{ secrets.NAME }} 这种写法,这样文件可以提交进仓库,而值留在外面。
  3. roles 决定这个模型出现在哪些场景。小的免费模型通常做 chat 没问题、做 apply 不可靠;给它配一个扛不住的 role,表现是编辑结果乱掉,而不是 API 报错。
  4. @ 开头的 model id(例如 Cloudflare 的)必须加引号,因为 YAML 保留了这个字符。

这条命令会生成什么文件

运行 npx free-llm-api setup continue 会写出 config.yaml。它由清单生成,所以 base URL 和 model id 都是服务商文档里的原值,不用你再去翻。下面是按 GroqCloud 填好的样子:

name: GroqCloud Free LLM
version: 0.1.0
schema: v1
models:
  - name: GroqCloud llama-3.3-70b-versatile
    provider: openai
    model: llama-3.3-70b-versatile
    apiBase: https://api.groq.com/openai/v1
    apiKey: ${{ secrets.GROQ_API_KEY }}
    roles:
      - chat
      - edit
      - apply

那个文件里没有 key。值在运行时从 GROQ_API_KEY 读取——就这一个习惯,从结构上保证凭据进不了仓库。

哪些免费额度适合 Continue

本站有 22 家既提供 OpenAI 协议又不要信用卡,配 Continue 最值得先试。完整名单(含要求绑卡的那些)在清单页

服务商Base URL官方公布限额
Google Gemini API https://generativelanguage.googleapis.com/v1beta/openai/ 按项目层级设定
GroqCloud https://api.groq.com/openai/v1 每分钟 30 次请求,每天 1000 次请求
SambaNova Cloud https://api.sambanova.ai/v1 每分钟 20 次请求,每天 20 次请求
Cohere https://api.cohere.ai/compatibility/v1 每分钟 20 次请求
Cloudflare Workers AI https://api.cloudflare.com/client/v4/accounts/ACCOUNT_ID/ai/v1 以计算单位公布
Hugging Face Inference Providers https://router.huggingface.co/v1 以额度余额公布
SiliconFlow https://api.siliconflow.com/v1 每分钟 1000 次请求
Fireworks AI https://api.fireworks.ai/inference/v1 每分钟 10 次请求

用免费额度该有什么预期

Continue 会持续携带已打开文件的上下文,所以请求体积是随会话增长的,而不是随你输入的字数增长。每日 token 上限会比每日请求上限先卡住你。

在怪客户端之前,先验 key 本身:浏览器检测页能把「凭据被拒」「被限流」和「端点根本没起来」这三种情况分开,而它们的解法各不相同。

来源

这里引用的服务商数字,都来自各家自己的文档,核验日期 2026-07-25。哪些内容会被记录、哪些是有意留空的,见数据方法