开发者文档
接入 Lai.vc 网关
几分钟完成接入,把稳定性、故障转移与可观测性交给网关。下方是完整的 API 与工具参考。
开始
介绍
Lai.vc 是一个生产级 AI 聚合网关,把主流模型供应商聚合到统一的、兼容 OpenAI 协议的接口之后, 在网关层提供多源智能路由、无感故障转移、按 Key 的用量与限制管控。把现有 OpenAI SDK 的 baseURL 换成我们的地址即可,业务代码零改动。
统一接口
兼容 OpenAI 协议,零成本迁移
多源高可用
同模型多上游,按优先级自动故障转移
¥1 = $1
按量计费,控制台实时看用量
开始
快速开始
两件事:① 在控制台创建一个 API Key(创建时选「接入点」); ② 把 SDK 的 baseURL 指向 Lai.vc 地址。模型名要用你 Key 所属接入点下的模型(见下方「接入点」)。
⚠️ 接入地址规则(最常见的坑,务必看清)
Claude 系工具 —— 不要加 /v1
Claude Code、ccswitch 等(走 Anthropic 协议)
ANTHROPIC_BASE_URL=https://api.lai.vcSDK 会自己拼 /v1/messages。加了 /v1 反而 404 报错。
Codex / OpenAI 系 —— 必须加 /v1
Codex CLI、OpenAI SDK 及各类 OpenAI 兼容客户端
base_url=https://api.lai.vc/v1地址结尾 一定要带 /v1,否则连不上。
两条线路任选其一(完全等价):官方线路 api.lai.vc(全球稳定) · 优化线路 fast.lai.vc(香港边缘加速,国内更快)。 想换线路,把上面地址里的 api.lai.vc 改成 fast.lai.vc 即可,/v1 规则不变。
from openai import OpenAI
client = OpenAI(
base_url="https://api.lai.vc/v1",
api_key="sk-..." # 你的 Lai.vc Key
)
resp = client.chat.completions.create(
model="gpt-5.5",
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai"
const client = new OpenAI({
baseURL: "https://api.lai.vc/v1",
apiKey: process.env.LAI_API_KEY,
})
const res = await client.chat.completions.create({
model: "gpt-5.5",
messages: [{ role: "user", content: "你好" }],
})
console.log(res.choices[0].message.content)curl https://api.lai.vc/v1/chat/completions \
-H "Authorization: Bearer $LAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.5",
"messages": [{ "role": "user", "content": "你好" }]
}'开始
认证
所有请求在 Authorization 头携带 Bearer <你的 Key>。可在控制台创建多个 Key、按项目隔离用量, 并为每个 Key 设置消费上限、模型白名单、IP 白名单与有效期。
请勿在前端/客户端暴露 Key。建议放服务端环境变量或经自己的后端代理调用。
开始
接入点(分组)
每个 Key 绑定一个接入点,只能调用该接入点下的模型。创建 Key 时选择,之后可在控制台列表或详情里随时切换。常见接入点:
| 接入点 | 覆盖模型 |
|---|---|
| Pro 满血官渠 | GPT 与 Codex(gpt-5.5 / gpt-5.4 / gpt-5.3-codex-spark …) |
| Max 满血官渠 | Claude(claude-opus-4-8 / claude-sonnet-4-6 …) |
| Gemini 官渠 | Google Gemini(gemini-3.1-pro-preview / gemini-3.5-flash …) |
| 国产官渠 | 智谱 / DeepSeek / Kimi / MiniMax / 通义(GLM-5.2 / deepseek-v4-pro …) |
| OpenAI 网安 | 镜像审核线 codex / gpt(-secure 系列) |
调用了不属于当前接入点的模型,会返回「无可用渠道」。需要跨线就切换 Key 的接入点,或为不同线各建一个 Key。
核心 API
对话补全
最常用的接口,完全兼容 OpenAI 的请求与响应结构。常用参数:
| 参数 | 类型 | 说明 |
|---|---|---|
| model | string | 模型 ID,如 gpt-5.5 / claude-opus-4-8 |
| messages | array | 对话消息列表 |
| stream | boolean | 是否流式返回,默认 false |
| temperature | number | 采样温度,0–2 |
| max_tokens | integer | 最大生成 token 数 |
Claude 模型同时支持 Anthropic 原生 /v1/messages 接口(满血 Claude Code 线走此协议)。
核心 API
模型列表
该接口返回你当前 Key 可用的模型清单。下表为部分在售模型, 完整列表与实时价格见模型广场。
| 模型 ID | 供应商 | 接入点 |
|---|---|---|
| gpt-5.5 | OpenAI | Pro 满血官渠 |
| gpt-5.3-codex-spark | OpenAI | Pro 满血官渠 |
| claude-opus-4-8 | Anthropic | Max 满血官渠 |
| claude-sonnet-4-6 | Anthropic | Max 满血官渠 |
| gemini-3.1-pro-preview | Gemini 官渠 | |
| deepseek-v4-pro | DeepSeek | 国产官渠 |
| GLM-5.2 | 智谱 | 国产官渠 |
| kimi-k2.6 | Kimi | 国产官渠 |
核心 API
流式响应
设 stream: true 即可逐 token 接收(SSE),适合聊天界面等低延迟场景。
stream = client.chat.completions.create(
model="gpt-5.5",
messages=[{"role": "user", "content": "用一句话介绍 Lai.vc"}],
stream=True,
)
for chunk in stream:
print(chunk.choices[0].delta.content or "", end="", flush=True)网关能力
多源与故障转移
每个接入点下的同一模型可由多个上游供货。网关按优先级选最优源, 某个源返回 429/超时/报错时,自动切到下一个健康源 —— 对你的请求无感知,无需自己写重试。
便宜源优先,既省成本又冗余;单源故障不影响整条线的可用性。
网关能力
限制与配额
每个 Key 可在控制台独立设置,用于团队/项目管控:
- 消费上限 —— 到额自动停用,防止失控。
- 模型白名单 —— 限定这把 Key 只能调指定模型。
- IP 白名单 —— 只允许指定 IP/CIDR 调用。
- 有效期 —— 到期自动失效。
用量、来源 IP、模型分布与调用明细都可在控制台「密钥详情」查看。
网关能力
错误码
| 状态码 | 含义 | 建议 |
|---|---|---|
| 401 | 认证失败 | 检查 Key 是否正确、是否已停用 |
| 403 | 无可用渠道 / 无权访问 | 确认模型属于该 Key 的接入点 |
| 429 | 触发限流 | 网关会自动转移,必要时降低并发 |
| 402 | 余额不足 | 前往控制台充值 |
| 5xx | 上游错误 | 网关会重试备用源,持续报错请联系支持 |
工具
接入工具
Lai.vc 兼容所有 OpenAI 官方与社区 SDK(Python / Node / Go / …),也兼容 Cursor、Cline、各类 Agent/CLI —— 凡是能填 base_url + api_key 的客户端,把地址指向 https://api.lai.vc/v1 即可。
若希望本机 IDE / CLI / Agent 免手动配置一键接入,可使用 LaiCode(设备授权, 自动写入配置)。详见 Laicode 接入指南。
工具
获取支持
接入遇到问题,可在控制台查看密钥用量与调用明细排查,或联系技术支持。