为什么需要
出海做产品调用海外 LLM API,账单是个无底洞——GPT-5.6、Claude Fable 5、Gemini 3.1 Pro 按 token 收费,做 AI 客服、批量内容生成时每月账单轻松破 $1000。但其实很多 AI CLI 工具(Codex、Claude Code、Grok Build)订阅费固定($20-200/月),用 CLI 跑能薅到模型羊毛。
CLIProxyAPI 把这件事自动化:在本地启动一个 Go 二进制,把 Codex/Claude Code/Grok/Kimi CLI 的订阅账号包装成 OpenAI/Gemini/Claude 兼容的 HTTP API。你的应用代码 0 改动——原来是 openai.ChatCompletion.create(...),现在把 base URL 指到本地 http://localhost:8317/v1 就完事。相当于用 $20/月的订阅费跑出原本要 $1000/月 API 调用的效果。
怎么用
从 GitHub Releases 下载二进制(macOS、Linux、Windows 全平台):
wget https://github.com/router-for-me/CLIProxyAPI/releases/latest/download/CLIProxyAPI_linux_amd64.tar.gz
tar -xzf CLIProxyAPI_linux_amd64.tar.gz
cd CLIProxyAPI
./cli-proxy-api
启动后监听 http://localhost:8317,按提示登录各个 CLI(弹 OAuth 窗口)。
在 Python 代码里调用:
from openai import OpenAI
client = OpenAI(
api_key="dummy", # CLIProxyAPI 不需要 key,但 OpenAI SDK 强制要求
base_url="http://localhost:8317/v1",
)
resp = client.chat.completions.create(
model="gpt-5.6", # 实际走 Codex CLI 订阅
messages=[{"role": "user", "content": "Hello"}],
)
同样的代码用 model="claude-fable-5" 走 Claude Code 订阅,model="gemini-3.1-pro" 走 Gemini CLI,model="grok-4.5" 走 Grok Build。
核心特性
- 统一 API — 一个端点暴露 OpenAI Responses / Gemini Interactions / Claude Messages 三种协议
- 多 CLI 聚合 — Codex、Claude Code、Grok Build、Antigravity、Kimi 同时支持,账号池可负载均衡
- 协议完整 — 流式响应、Function Calling、Vision、多轮对话都支持
- 零代码迁移 — 现有 OpenAI/Gemini/Claude SDK 代码改一行 base URL 即可
- Go 高性能 — 单二进制启动,资源占用极低
- 多账号管理 — 每个 provider 支持多个账号,自动轮询避免速率限制
使用案例
出海开发者做一个 AI 内容生成 SaaS,原来用 OpenAI API 直连,月账单 $800。改用 CLIProxyAPI + Codex $20/月订阅,账单降到 $20,业务跑一个月内容生成量翻 3 倍还没超订阅额度。同时还能在代码里混用不同模型——文本生成用 Codex(便宜),代码审查用 Claude Fable(强),图像理解用 Gemini 3.1 Pro。
另一个场景:海外小团队做内部 AI 助手。团队 5 人共享一个本地 CLIProxyAPI 服务,每个人用自己的 CLI 订阅,团队内部 API 调用走本地代理不收费,零外部账单。
注意事项
- MIT 协议,可商用
- 需要本地有对应 CLI 工具的活跃订阅
- Go 单二进制,资源占用低,建议 1 核 1G 起步
- 各 CLI 平台 ToS 严格,商业产品对外提供服务前需评估合规风险
- 个人开发/内部使用完全没问题,对外提供 SASS 服务建议直接买官方 API