快速开始与 API 参考
一个 API Key,OpenAI 兼容接口,3 分钟接入全部主流模型。
模型名称与兼容别名
新接入使用下表的新名称作为 JSON 请求的 model。旧名称继续可用,对应同一模型、价格和 Key 权限。具体可用性以实时目录为准。
| 接入模型名称 | 兼容旧名称 |
|---|
POST /v1/images/generations
{"model":"图片生成模型i2","prompt":"白色背景的产品图片","n":1}
image2 也可继续调用图片生成模型i2。URL 中的中文名称需进行 URL 编码;响应中的路由、审计和计费标识保留稳定内部名称。
快速开始
将 OpenAI SDK 的 base_url 指向
https://unibaseai.cn/v1,
并使用 Unibase 模型 API Key 鉴权(Bearer Token),即可完成迁移。
from openai import OpenAI
client = OpenAI(
base_url="https://unibaseai.cn/v1",
api_key="YOUR_UNIBASE_API_KEY",
)
resp = client.chat.completions.create(
model="auto-chat", # 智能路由,或指定任意模型 ID
messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)
curl https://unibaseai.cn/v1/chat/completions \
-H "Authorization: Bearer YOUR_UNIBASE_API_KEY" \
-H "Content-Type: application/json" \
-d '{ "model": "auto-chat", "messages": [{"role":"user","content":"你好"}] }'
身份验证
所有 API 请求需要在 Authorization
请求头中携带 Bearer Token:
Authorization: Bearer YOUR_UNIBASE_API_KEY
完整 API Key 只会在创建或轮换后显示一次,可在控制台吊销。Key 仅用于 Unibase 网关,供应商凭据始终保留在服务端。
Chat Completions
/v1/chat/completions
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| model | string | 是 | auto-chat 智能路由(支持 :quality / :cost 后缀),或固定模型 ID,如 kimi-k3 |
| messages | array | 是 | OpenAI 标准消息数组 |
| stream | boolean | 否 | 设为 true 时以 SSE 流式返回,格式与 OpenAI 一致 |
| temperature | number | 否 | 0–2,默认 1 |
流式响应
传入 "stream": true 后,响应为 SSE 事件流,逐块返回 choices[].delta,以 data: [DONE] 结束。计费在流结束后按实际 token 结算。
Responses API
/v1/responses
使用相同的 API Key 与 Base URL 调用 OpenAI Responses 兼容接口。工具调用与推理强度是否可用,以实时模型目录声明为准。
Anthropic Messages
/v1/messages
Anthropic 兼容客户端使用模型 API Key,并发送 anthropic-version 请求头。消息、工具调用和 SSE 事件由网关进行协议适配。
视频生成接口
/v1/videos/generations
视频生成采用异步任务接口。提交后按响应中的任务 ID 查询进度,成功后再获取限时播放或下载地址。
打开视频生成页面 →Analytics API
/v1/usage
账户所属的模型 API Key 可按模型、Key、日期、成员、项目或业务标签汇总用量,并按时间、状态、延迟与标签筛选。
路由策略
使用 auto-chat 系列模型 ID 时,Unibase 根据策略在旗舰模型间智能路由:
auto-chat
均衡模式。综合质量与成本,默认推荐,适合绝大多数对话场景。
auto-chat:quality
质量优先。优先路由至当前质量评分最高的旗舰模型。
auto-chat:cost
成本优先。优先路由至性价比最高的模型,成本可预期。
可验证的路由
每次路由调用的响应头都会返回 x-unibase-routed-model,标明实际命中的模型(如 glm-5.2),账单与日志中同样可查,拒绝黑盒。
错误处理
| 状态码 | 含义 | 处理建议 |
|---|---|---|
| 401 | 未授权 | 检查 API Key 是否正确、是否已吊销;确认 Authorization: Bearer 头格式 |
| 402 | 余额不足 | 账户余额不足,请充值后重试;可在控制台设置余额预警 |
| 429 | 触发预算熔断或限流 | 超出预算阈值或 QPS 限制;检查预算设置,采用指数退避重试 |
| 500 | 上游异常 | 上游模型服务异常,请稍后重试;持续出现请联系支持并提供 request ID |