Leonis AI 是一个 AI API 中转网关(AI API Gateway / LLM Proxy),把 Claude、OpenAI、Google Gemini、xAI Grok 的 114 个模型聚合到同一个 Base URL + 同一个 Key 下。
原本你需要四个平台的账号、几张外币信用卡、四套 SDK;现在改一行 BASE_URL 就够了。
- ANTHROPIC_BASE_URL=https://api.anthropic.com
+ ANTHROPIC_BASE_URL=https://ai.svtun.cn| 官方直连 | Leonis AI 网关 | |
|---|---|---|
| 网络环境 | 需自备国际网络 | 国内直连 |
| 支付方式 | 外币信用卡 | 支付宝 / 微信 |
| 账号数量 | 每家一个 | 一个 Key 全平台 |
| 计费方式 | 各平台独立账单 | 统一余额,实时可查 |
| Claude Opus | 需 Max 订阅($100/月起) | 按量付费,用多少扣多少 |
| 用量窗口 | Pro/Max 有 5h 窗口限制 | 无窗口限制 |
export ANTHROPIC_BASE_URL="https://ai.svtun.cn"
export ANTHROPIC_AUTH_TOKEN="sk-your-key-here"
claude# ~/.codex/config.toml
model_provider = "leonis"
[model_providers.leonis]
name = "Leonis AI"
base_url = "https://ai.svtun.cn/v1"
wire_api = "responses"
env_key = "LEONIS_API_KEY"from openai import OpenAI
client = OpenAI(
base_url="https://ai.svtun.cn/v1",
api_key="sk-your-key-here",
)
resp = client.chat.completions.create(
model="gpt-5.6-sol",
messages=[{"role": "user", "content": "Hello"}],
)from anthropic import Anthropic
client = Anthropic(
base_url="https://ai.svtun.cn",
auth_token="sk-your-key-here",
)
msg = client.messages.create(
model="claude-opus-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello"}],
)📖 更多客户端(Cursor / Cline / Roo Code / Cherry Studio / ChatBox / NextChat / OpenWebUI)配置见 ai-client-configs
| ⭐ Anthropic 10 | OpenAI 13 | Google Gemini 78 | xAI Grok 13 |
|---|---|---|---|
|
编码首选
|
Codex 原生
|
覆盖最全
|
含图像视频
|
📋 查看全部 114 个模型 → 支持搜索过滤,点击即复制模型名
Gemini 变体后缀速查:-thinking 开思考链 | -nothinking 关思考链(最省) | -search 内置联网 | -image 出图 | -2k/-4k 输出分辨率 | -latest 自动跟随最新版
| 端点 | 协议 | 典型客户端 |
|---|---|---|
/v1/messages |
Anthropic Messages | Claude Code、Anthropic SDK、Cline |
/v1/chat/completions |
OpenAI Chat | 绝大多数第三方客户端;Gemini 与 Grok 走这个 |
/v1/responses |
OpenAI Responses | Codex CLI、Codex Desktop |
- 🔀 多平台聚合 — Claude / OpenAI / Gemini / Grok 共 114 个模型,一个 Key 全通
- 🎨 图像生成 — Nano Banana Pro、Imagen 4.0 Ultra、gpt-image-2、Grok Imagine 全都在
- ⚡ Prompt 缓存 — 完整支持 Anthropic Prompt Caching,长代码长文档重复读取近乎零成本
- 📊 用量可追溯 — 每一次请求、每一笔 Token 消耗、每一分钱都有明细,随时可查
- 🔁 多通道容灾 — 多上游节点自动调度,单点故障自动切换
- 🎚️ 分组倍率 — 按需选择通道,经济通道与高速通道自由切换
- 🌐 国内直连 — 无需额外网络配置
|
Claude Code 中文完全指南 安装、配置、第三方 API 接入、成本优化、常见报错排查。从零到熟练的完整路径。 |
Codex CLI 完全配置手册
|
|
Gemini API 中文配置手册 78 个模型详解、命名规则拆解、thinking / search 变体、Nano Banana 与 Imagen 生图。 |
多配置一键切换 用 cc-switch 管理 Claude Code 与 Codex 的多套供应商配置,点一下就切换。 |
|
AI 网关与中转生态精选 开源网关、协议转换、路由调度、可观测性 —— 一份持续更新的 awesome 清单。 |
成本计算与缓存经济学 为什么 Claude Code 的账单和你想的不一样,附可运行的成本计算器。 |
|
客户端对接配置合集 20+ 主流 AI 客户端的 Base URL 配置模板,复制即用。 |
在线可搜索模型清单 Claude / GPT / Gemini / Grok 全系模型名,支持关键词过滤,点击即复制。 |
和 one-api / new-api / sub2api 这类项目是什么关系?
那些是自建网关的开源软件,你需要自己部署、自己找上游、自己维护。
Leonis AI 是已经部署好的托管服务 —— 你不用管服务器、不用管上游账号、不用管故障切换,拿 Key 直接用。
如果你想自建,awesome-ai-api-gateway 里整理了全部可选方案。
会不会封我的账号?
不会。走的是 API 网关,全程不接触你的 Claude / OpenAI 账号,你甚至不需要有这些账号。
支持 Prompt 缓存吗?对 Claude Code 影响大吗?
完整支持。这一点对 Claude Code 尤其关键 —— Claude Code 每轮对话都会重发项目上下文,实测缓存读取可占总 Token 量的 67%~86%,有缓存和没缓存的成本能差好几倍。
怎么控制成本?
三条实操建议:
- 日常主用 Sonnet,卡关再切 Opus — Opus 单价约为 Sonnet 的 5 倍
- 善用
/clear— Claude Code 上下文越长,每轮重发的 Token 越多 - 配置
.claudeignore— 把node_modules、构建产物、大型资源文件排除掉