开发者文档

接入 Lai.vc 网关

几分钟完成接入,把稳定性、故障转移与可观测性交给网关。下方是完整的 API 与工具参考。

开始

介绍

Lai.vc 是一个生产级 AI 聚合网关,把主流模型供应商聚合到统一的、兼容 OpenAI 协议的接口之后, 在网关层提供多源智能路由、无感故障转移、按 Key 的用量与限制管控。把现有 OpenAI SDK 的 baseURL 换成我们的地址即可,业务代码零改动。

统一接口

兼容 OpenAI 协议,零成本迁移

多源高可用

同模型多上游,按优先级自动故障转移

¥1 = $1

按量计费,控制台实时看用量

开始

快速开始

两件事:① 在控制台创建一个 API Key(创建时选「接入点」); ② 把 SDK 的 baseURL 指向 Lai.vc 地址。模型名要用你 Key 所属接入点下的模型(见下方「接入点」)。

⚠️ 接入地址规则(最常见的坑,务必看清)

Claude 系工具 —— 不要加 /v1

Claude Code、ccswitch 等(走 Anthropic 协议)

ANTHROPIC_BASE_URL=https://api.lai.vc

SDK 会自己拼 /v1/messages加了 /v1 反而 404 报错。

Codex / OpenAI 系 —— 必须加 /v1

Codex CLI、OpenAI SDK 及各类 OpenAI 兼容客户端

base_url=https://api.lai.vc/v1

地址结尾 一定要带 /v1,否则连不上。

两条线路任选其一(完全等价):官方线路 api.lai.vc(全球稳定) · 优化线路 fast.lai.vc(香港边缘加速,国内更快)。 想换线路,把上面地址里的 api.lai.vc 改成 fast.lai.vc 即可,/v1 规则不变。

Python(openai SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.lai.vc/v1",
    api_key="sk-..."  # 你的 Lai.vc Key
)

resp = client.chat.completions.create(
    model="gpt-5.5",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)
Node.js(openai SDK)
import OpenAI from "openai"

const client = new OpenAI({
  baseURL: "https://api.lai.vc/v1",
  apiKey: process.env.LAI_API_KEY,
})

const res = await client.chat.completions.create({
  model: "gpt-5.5",
  messages: [{ role: "user", content: "你好" }],
})
console.log(res.choices[0].message.content)
cURL
curl https://api.lai.vc/v1/chat/completions \
  -H "Authorization: Bearer $LAI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.5",
    "messages": [{ "role": "user", "content": "你好" }]
  }'

开始

认证

所有请求在 Authorization 头携带 Bearer <你的 Key>。可在控制台创建多个 Key、按项目隔离用量, 并为每个 Key 设置消费上限、模型白名单、IP 白名单与有效期。

请勿在前端/客户端暴露 Key。建议放服务端环境变量或经自己的后端代理调用。

开始

接入点(分组)

每个 Key 绑定一个接入点,只能调用该接入点下的模型。创建 Key 时选择,之后可在控制台列表或详情里随时切换。常见接入点:

接入点覆盖模型
Pro 满血官渠GPT 与 Codex(gpt-5.5 / gpt-5.4 / gpt-5.3-codex-spark …)
Max 满血官渠Claude(claude-opus-4-8 / claude-sonnet-4-6 …)
Gemini 官渠Google Gemini(gemini-3.1-pro-preview / gemini-3.5-flash …)
国产官渠智谱 / DeepSeek / Kimi / MiniMax / 通义(GLM-5.2 / deepseek-v4-pro …)
OpenAI 网安镜像审核线 codex / gpt(-secure 系列)

调用了不属于当前接入点的模型,会返回「无可用渠道」。需要跨线就切换 Key 的接入点,或为不同线各建一个 Key。

核心 API

对话补全

POST/v1/chat/completions

最常用的接口,完全兼容 OpenAI 的请求与响应结构。常用参数:

参数类型说明
modelstring模型 ID,如 gpt-5.5 / claude-opus-4-8
messagesarray对话消息列表
streamboolean是否流式返回,默认 false
temperaturenumber采样温度,0–2
max_tokensinteger最大生成 token 数

Claude 模型同时支持 Anthropic 原生 /v1/messages 接口(满血 Claude Code 线走此协议)。

核心 API

模型列表

GET/v1/models

该接口返回你当前 Key 可用的模型清单。下表为部分在售模型, 完整列表与实时价格见模型广场

模型 ID供应商接入点
gpt-5.5OpenAIPro 满血官渠
gpt-5.3-codex-sparkOpenAIPro 满血官渠
claude-opus-4-8AnthropicMax 满血官渠
claude-sonnet-4-6AnthropicMax 满血官渠
gemini-3.1-pro-previewGoogleGemini 官渠
deepseek-v4-proDeepSeek国产官渠
GLM-5.2智谱国产官渠
kimi-k2.6Kimi国产官渠

核心 API

流式响应

stream: true 即可逐 token 接收(SSE),适合聊天界面等低延迟场景。

streaming.py
stream = client.chat.completions.create(
    model="gpt-5.5",
    messages=[{"role": "user", "content": "用一句话介绍 Lai.vc"}],
    stream=True,
)
for chunk in stream:
    print(chunk.choices[0].delta.content or "", end="", flush=True)

网关能力

多源与故障转移

每个接入点下的同一模型可由多个上游供货。网关按优先级选最优源, 某个源返回 429/超时/报错时,自动切到下一个健康源 —— 对你的请求无感知,无需自己写重试

便宜源优先,既省成本又冗余;单源故障不影响整条线的可用性。

网关能力

限制与配额

每个 Key 可在控制台独立设置,用于团队/项目管控:

  • 消费上限 —— 到额自动停用,防止失控。
  • 模型白名单 —— 限定这把 Key 只能调指定模型。
  • IP 白名单 —— 只允许指定 IP/CIDR 调用。
  • 有效期 —— 到期自动失效。

用量、来源 IP、模型分布与调用明细都可在控制台「密钥详情」查看。

网关能力

错误码

状态码含义建议
401认证失败检查 Key 是否正确、是否已停用
403无可用渠道 / 无权访问确认模型属于该 Key 的接入点
429触发限流网关会自动转移,必要时降低并发
402余额不足前往控制台充值
5xx上游错误网关会重试备用源,持续报错请联系支持

工具

接入工具

Lai.vc 兼容所有 OpenAI 官方与社区 SDK(Python / Node / Go / …),也兼容 Cursor、Cline、各类 Agent/CLI —— 凡是能填 base_url + api_key 的客户端,把地址指向 https://api.lai.vc/v1 即可。

若希望本机 IDE / CLI / Agent 免手动配置一键接入,可使用 LaiCode(设备授权, 自动写入配置)。详见 Laicode 接入指南

工具

获取支持

接入遇到问题,可在控制台查看密钥用量与调用明细排查,或联系技术支持。