Claude Opus 5、GPT-5.6、Gemini 3.6、Grok 4.5 —— 四家全系模型同一个入口。 兼容 Anthropic 与 OpenAI 双协议,原生支持 Claude Code 与 Codex CLI。 接入只需要改一个环境变量,你的代码一行都不用动。
请求进入网关后按模型名分流到对应上游。通道之间互为容灾,单点故障自动切换。
你的客户端支持哪种协议,就填哪个端点。SDK 与调用代码完全不变。
| 端点 | 协议 | 典型客户端 |
|---|---|---|
/v1/messages |
Anthropic Messages | Claude Code、Anthropic SDK、Cline |
/v1/chat/completions |
OpenAI Chat Completions | Cherry Studio、ChatBox、NextChat、LobeChat Gemini 与 Grok 模型也走这个端点 |
/v1/responses |
OpenAI Responses | Codex CLI、Codex Desktop |
# ~/.zshrc 或 ~/.bashrc export ANTHROPIC_BASE_URL="https://ai.svtun.cn" export ANTHROPIC_AUTH_TOKEN="sk-your-key" # 然后正常启动 $ claude
# ~/.codex/config.toml model_provider = "leonis" [model_providers.leonis] name = "Leonis AI" base_url = "https://ai.svtun.cn/v1" wire_api = "responses" env_key = "LEONIS_API_KEY"
from openai import OpenAI client = OpenAI( base_url="https://ai.svtun.cn/v1", api_key="sk-your-key", )
from anthropic import Anthropic client = Anthropic( base_url="https://ai.svtun.cn", auth_token="sk-your-key", )
Claude Code 每一轮都会重发项目上下文。开启 Prompt Caching 后,重复部分按缓存读取价计费 —— 这是长会话能不能用得起的分水岭。
直接填官方模型名调用,不需要改写代码或做模型名映射。
不需要。网关部署在国内可直连的节点上,配置完 BASE_URL 就能用。
不会。走的是 API 网关,全程不接触你的平台账号 —— 事实上你不需要拥有这些账号。
那些是自建网关的开源软件,需要你自己部署、自己接上游、自己维护。Leonis AI 是已经部署好的托管服务,拿 Key 直接用。想自建的话,awesome-ai-api-gateway 里整理了全部可选方案。
控制台有完整的请求日志:每一次请求的模型、输入输出 Token、缓存读写 Token、单次费用都能查到,可按时间、模型、API Key 筛选。
三条最有效的:日常任务主用 Sonnet,卡关再切 Opus(单次成本差约 5 倍);长会话及时 /clear,避免每轮重发膨胀的上下文;用 .claudeignore 把 node_modules、构建产物、大型资源排除出索引范围。
支持。SSE 流式、Tool Use / Function Calling、多模态图片输入均按官方协议透传。