快速开始与 API 参考

一个 API Key,OpenAI 兼容接口,3 分钟接入全部主流模型。

模型名称与兼容别名

新接入使用下表的新名称作为 JSON 请求的 model。旧名称继续可用,对应同一模型、价格和 Key 权限。具体可用性以实时目录为准。

接入模型名称兼容旧名称
POST /v1/images/generations
{"model":"图片生成模型i2","prompt":"白色背景的产品图片","n":1}

image2 也可继续调用图片生成模型i2。URL 中的中文名称需进行 URL 编码;响应中的路由、审计和计费标识保留稳定内部名称。

快速开始

将 OpenAI SDK 的 base_url 指向 https://unibaseai.cn/v1, 并使用 Unibase 模型 API Key 鉴权(Bearer Token),即可完成迁移。

main.py
from openai import OpenAI

client = OpenAI(
    base_url="https://unibaseai.cn/v1",
    api_key="YOUR_UNIBASE_API_KEY",
)

resp = client.chat.completions.create(
    model="auto-chat",  # 智能路由,或指定任意模型 ID
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)
curl
curl https://unibaseai.cn/v1/chat/completions \
  -H "Authorization: Bearer YOUR_UNIBASE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{ "model": "auto-chat", "messages": [{"role":"user","content":"你好"}] }'

身份验证

所有 API 请求需要在 Authorization 请求头中携带 Bearer Token:

HTTP 请求头
Authorization: Bearer YOUR_UNIBASE_API_KEY

完整 API Key 只会在创建或轮换后显示一次,可在控制台吊销。Key 仅用于 Unibase 网关,供应商凭据始终保留在服务端。

Chat Completions

POST /v1/chat/completions
参数 类型 必填 说明
model string auto-chat 智能路由(支持 :quality / :cost 后缀),或固定模型 ID,如 kimi-k3
messages array OpenAI 标准消息数组
stream boolean 设为 true 时以 SSE 流式返回,格式与 OpenAI 一致
temperature number 0–2,默认 1

流式响应

传入 "stream": true 后,响应为 SSE 事件流,逐块返回 choices[].delta,以 data: [DONE] 结束。计费在流结束后按实际 token 结算。

Responses API

POST /v1/responses

使用相同的 API Key 与 Base URL 调用 OpenAI Responses 兼容接口。工具调用与推理强度是否可用,以实时模型目录声明为准。

Anthropic Messages

POST /v1/messages

Anthropic 兼容客户端使用模型 API Key,并发送 anthropic-version 请求头。消息、工具调用和 SSE 事件由网关进行协议适配。

视频生成接口

POST /v1/videos/generations

视频生成采用异步任务接口。提交后按响应中的任务 ID 查询进度,成功后再获取限时播放或下载地址。

打开视频生成页面 →

Analytics API

GET /v1/usage

账户所属的模型 API Key 可按模型、Key、日期、成员、项目或业务标签汇总用量,并按时间、状态、延迟与标签筛选。

路由策略

使用 auto-chat 系列模型 ID 时,Unibase 根据策略在旗舰模型间智能路由:

auto-chat

均衡模式。综合质量与成本,默认推荐,适合绝大多数对话场景。

auto-chat:quality

质量优先。优先路由至当前质量评分最高的旗舰模型。

auto-chat:cost

成本优先。优先路由至性价比最高的模型,成本可预期。

可验证的路由

每次路由调用的响应头都会返回 x-unibase-routed-model,标明实际命中的模型(如 glm-5.2),账单与日志中同样可查,拒绝黑盒。

错误处理

状态码 含义 处理建议
401 未授权 检查 API Key 是否正确、是否已吊销;确认 Authorization: Bearer 头格式
402 余额不足 账户余额不足,请充值后重试;可在控制台设置余额预警
429 触发预算熔断或限流 超出预算阈值或 QPS 限制;检查预算设置,采用指数退避重试
500 上游异常 上游模型服务异常,请稍后重试;持续出现请联系支持并提供 request ID