| 模型 | - |
|---|---|
| 密钥前缀 | - |
| 状态 | - |
| 有效期 | - |
输入充值码,额度与有效期会叠加到当前密钥。
直接在网页里对话验证密钥是否可用。测试会真实消耗 token 额度, 与通过 API 调用完全一致。
把网关地址当作 OpenAI 兼容的 base_url 使用,可直接复制下面片段:
| Base URL | - |
|---|---|
| 鉴权方式 | 请求头 Authorization: Bearer <你的密钥>(也支持 X-Api-Key) |
| Content-Type | application/json |
| 协议 | OpenAI 兼容,可直接复用官方 SDK |
| 方法 | 路径 | 说明 | 计费 |
|---|---|---|---|
| GET | /v1/models | 列出当前密钥绑定的模型 | 否 |
| POST | /v1/chat/completions | 对话补全(支持流式) | 是 |
| POST | /v1/completions | 文本补全 | 是 |
| POST | /v1/embeddings | 向量化 | 是 |
每个密钥绑定唯一模型。请求体中的 model 必须与该密钥绑定的模型完全一致,
否则返回 403 model_mismatch,且不产生计费。请调用 /v1/models 获取可用模型。
| 字段 | 类型 | 说明 |
|---|---|---|
choices[].message.content | string | 模型回复内容 |
usage.prompt_tokens | int | 输入消耗的 token |
usage.completion_tokens | int | 输出消耗的 token |
usage.total_tokens | int | 本次总计消耗(计入额度) |
按上游返回的真实 usage.total_tokens 结算。请求发出前会先预扣
(预估 prompt + max_tokens),若剩余额度不足以覆盖预扣,请求会被
429 quota_exceeded 拒绝且不扣费;请求结束后按实际用量多退少补。
上游未返回用量时,按预扣值兜底结算。
首次成功请求时开始计时(此前显示"未激活")。激活后按密钥配置的天数计算到期时间;
validity_days 为 0 表示永久有效。
| HTTP | code | 含义与处理 |
|---|---|---|
| 401 | invalid_api_key | 密钥不存在或未提供,检查密钥与请求头 |
| 401 | key_disabled | 密钥已被管理员禁用 |
| 401 | key_expired | 密钥已过期,请充值或联系管理员 |
| 403 | model_mismatch | model 与密钥绑定不一致(不计费) |
| 404 | not_found | 路径不存在 |
| 413 | payload_too_large | 请求体超过大小限制 |
| 429 | quota_exceeded | 额度不足(含预扣),请充值 |
| 429 | rate_limit_exceeded | 并发过高,稍后重试 |
| 502 | upstream_error | 上游异常,可重试 |
| 503 | upstream_not_configured | 服务端未配置上游,请联系管理员 |