服务商如何进入编码短名单
本页从有详细资料的 25 家中选出 16 家。服务商必须公开 OpenAI 兼容端点,并列出代码模型,或被编码工具广泛使用的 Llama、Qwen、gpt-oss 系列。这是能够由清单重复计算的规则,不是跑分结论。入选不代表模型最擅长写代码、支持所有 Agent 能力,或免费容量足以处理大型仓库。
编码客户端可以尝试的端点
这 16 家会展示官方免费形式、公布限额与 Base URL。页面刻意不做唯一「最佳」评分,因为 Agent 效果取决于编辑格式、工具调用、上下文长度、延迟和具体代码库。打开服务商详情页复制精确模型 ID;把市场宣传中的系列名当成 API ID,是最常见的配置失败之一。
| 服务商 | 免费形式 | 官方公布限额 | 信用卡 | Base URL |
|---|---|---|---|---|
| GroqCloud | 厂商免费额度 | 每分钟 30 次请求,每天 1000 次请求 | 不需要 | https://api.groq.com/openai/v1 |
| SambaNova Cloud | 厂商免费额度 | 每分钟 20 次请求,每天 20 次请求 | 不需要 | https://api.sambanova.ai/v1 |
| Cloudflare Workers AI | 厂商免费额度 | 以计算单位公布 | 不需要 | https://api.cloudflare.com/client/v4/accounts/ACCOUNT_ID/ai/v1 |
| Hugging Face Inference Providers | 厂商免费额度 | 以额度余额公布 | 不需要 | https://router.huggingface.co/v1 |
| SiliconFlow | 厂商免费额度 | 每分钟 1000 次请求 | 不需要 | https://api.siliconflow.com/v1 |
| Fireworks AI | 厂商免费额度 | 每分钟 10 次请求 | 不需要 | https://api.fireworks.ai/inference/v1 |
| Mistral La Plateforme | 厂商免费额度 | 有限流但未公布数值 | 不需要 | https://api.mistral.ai/v1 |
| Alibaba Cloud Model Studio | 厂商免费额度 | 按模型公布 | 不需要 | https://dashscope-intl.aliyuncs.com/compatible-mode/v1 |
| Ollama Cloud | 厂商免费额度 | 有限流但未公布数值 | 不需要 | https://ollama.com/v1 |
| Cerebras Inference | 注册赠送额度 | 每分钟 5 次请求 | 需要 | https://api.cerebras.ai/v1 |
| Vercel AI Gateway | 注册赠送额度 | 以额度余额公布 | 不需要 | https://ai-gateway.vercel.sh/v1 |
| Together AI | 按量计费 | 动态,无固定数值 | 不需要 | https://api.together.xyz/v1 |
| Nebius Token Factory | 按量计费 | 每分钟 60 次请求 | 不需要 | https://api.tokenfactory.nebius.com/v1 |
| DeepInfra | 按量计费 | 有限流但未公布数值 | 不需要 | https://api.deepinfra.com/v1/openai |
| Chutes | 按量计费 | 按付费计划公布 | 不需要 | https://llm.chutes.ai/v1 |
| Scaleway Generative APIs | 按量计费 | 有限流但未公布数值 | 需要 | https://api.scaleway.ai/v1 |
按 Agent 循环的特点选择
自动补全更依赖低延迟和足够的每分钟吞吐,仓库 Agent 则需要更长上下文和可靠的工具调用。命令行助手可能只用标准 chat completions,自主编辑器却会依赖流式、结构化参数和多次重试。选两家优势不同的候选,用相同的小任务实测,同时检查最终补丁和整个循环消耗的请求数,再做决定。
Agent 会放大免费限额的影响
一个 Agent 会把一条指令拆成几十次模型调用:读文件、提出修改、运行测试,再修复失败。聊天时显得宽松的额度,跑仓库任务可能很快撞到每日请求上限;大上下文还会更快消耗 Token,重试循环则同时放大延迟和用量。设置最大轮数,让命令保持可审阅;如果客户端允许,把探索阶段交给更小的模型。
配置时不要让 key 进入仓库
使用本站的客户端页面,为 Codex、Cline、Continue、Cursor 或 Claude Code 生成或核对 Base URL 与模型配置。凭据只放在环境变量或客户端自己的安全存储中。先在一次性分支上执行边界很小的任务,审阅每一条 Shell 命令,并要求正常测试套件通过后再接受修改。免费只改变成本,不会降低 Agent 在本机能够行使的权限。
本页实际核验了什么
服务商协议、模型 ID、免费条款与官方限额核验于 2026-07-25;本页没有暗示任何虚构的编码跑分。数据方法记录这些事实如何取得资格,key 检测页则帮助你在客户端把状态吞成通用连接错误之前先诊断自己的凭据。工具里某个模型消失时,请重新查看服务商页面。