API 文档

与 OpenAI 协议完全兼容。把 base_url 指向网关,其余照旧。

快速开始

把 SDK 的 base_url 换成 https://api.quark.ink/v1,api_key 换成管理员签发的 qk_****,一行改动即可接入已授权模型。

quickstart.py
from openai import OpenAI

client = OpenAI(
    base_url="https://api.quark.ink/v1",  # 只改这行
    api_key="qk_****",
)

resp = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role": "user", "content": "你好,Quark"}],
)
print(resp.choices[0].message.content)

认证

所有请求在 Authorization 头携带 Key,格式为 Bearer qk_****。Key 由管理员签发,客户控制台只展示 Key 元数据。

terminal
curl https://api.quark.ink/v1/models \
  -H "Authorization: Bearer qk_****"

每个 Key 只能调用管理员配置的模型路由;未授权模型返回 404,未授权上游覆盖返回 403。

Chat Completions

POST /v1/chat/completions

请求与响应字段与 OpenAI 协议一致,现有 SDK 与工具链零改造。

request.json
{
  "model": "glm-5.2",
  "messages": [
    {"role": "system", "content": "回答保持简短。"},
    {"role": "user", "content": "你好,Quark"}
  ],
  "temperature": 0.7,
  "max_tokens": 1024
}
response.json
{
  "id": "chatcmpl-9f2a1c",
  "object": "chat.completion",
  "created": 1784592000,
  "model": "glm-5.2",
  "choices": [
    {
      "index": 0,
      "message": {"role": "assistant", "content": "你好,这里是 Quark。"},
      "finish_reason": "stop"
    }
  ],
  "usage": {"prompt_tokens": 18, "completion_tokens": 9, "total_tokens": 27}
}
参数类型必填说明
modelstring模型名,见下方模型列表
messagesarray对话消息,role 支持 system/user/assistant
streamboolean默认 false,开启后以 SSE 逐块返回
temperaturenumber采样温度 0–2,默认 1
max_tokensinteger生成上限,缺省由模型决定

流式

请求体加 "stream": true,响应转为 SSE,每块一个 chunk,最后以 data: [DONE] 收尾。

event-stream
data: {"id":"chatcmpl-9f2a1c","object":"chat.completion.chunk","choices":[{"index":0,"delta":{"role":"assistant","content":""}}]}

data: {"id":"chatcmpl-9f2a1c","object":"chat.completion.chunk","choices":[{"index":0,"delta":{"content":"你好"}}]}

data: {"id":"chatcmpl-9f2a1c","object":"chat.completion.chunk","choices":[{"index":0,"delta":{"content":",这里是 Quark。"}}]}

data: {"id":"chatcmpl-9f2a1c","object":"chat.completion.chunk","choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}

data: [DONE]

错误码

错误响应体与 OpenAI 协议一致,含 error.code error.message

状态码含义处理建议
401无效 Key检查 Key 拼写与撤销状态,必要时重新签发
403上游覆盖未授权移除 x-quark-upstream,或联系管理员调整该 Key 的路由
404模型未授权检查模型名,或联系管理员为该 Key 配置模型路由
429触发限流按 Retry-After 退避重试,或升级套餐
500上游异常稍后重试,网关已自动上报并切换通道
503通道降级上游拥塞,稍候再试或临时切换模型

模型列表

折扣对比官方牌价实时换算,牌价变动同步生效。

模型厂商上下文输入输出
glm-5.2Zhipu128K3.4 折3.0 折
glm-5.1Zhipu128K3.4 折3.0 折
glm-5vZhipu128K3.6 折3.2 折
glm-5-airZhipu128K2.9 折2.9 折
deepseek-v4-proDeepSeek256K6.6 折6.9 折
deepseek-v4DeepSeek256K4.9 折5.2 折
deepseek-v4-flashDeepSeek128K2.7 折2.7 折
deepseek-coder-v4DeepSeek128K3.1 折3.1 折
kimi-k2.7Moonshot256K3.0 折3.0 折
kimi-k2.7-codeMoonshot256K2.8 折2.8 折
kimi-k2.6Moonshot256K2.8 折2.8 折
kimi-k2.6-vlMoonshot128K3.2 折3.2 折
kimi-k2.5Moonshot256K2.8 折2.8 折
minimax-m3MiniMax256K2.8 折2.8 折
minimax-m2.7MiniMax128K2.8 折2.8 折
minimax-m3-liteMiniMax128K2.5 折2.5 折
qwen3.7-maxAlibaba1M5.2 折5.5 折
qwen3.7-plusAlibaba256K3.9 折3.9 折
qwen3.7-turboAlibaba128K2.6 折2.6 折
qwen3.7-coderAlibaba256K3.4 折3.4 折
qwen3.5-vlAlibaba128K3.8 折3.8 折
qwen3.6-plusAlibaba128K4.8 折4.8 折
doubao-2.2-proByteDance256K3.3 折3.5 折
doubao-2.2-vlByteDance128K3.5 折3.5 折
doubao-2.2-liteByteDance128K2.4 折2.4 折
ernie-5.5Baidu256K4.2 折4.5 折
ernie-5.5-turboBaidu128K2.9 折2.9 折
hunyuan-t2Tencent256K3.7 折3.9 折
hunyuan-2.5Tencent128K3.0 折3.0 折
step-3.5StepFun128K4.1 折4.3 折
spark-5.5iFlytek128K3.6 折3.6 折
yi-2.5-large01.AI128K3.5 折3.5 折
前往模型列表,按厂商与能力筛选 →

限流

额度按 Key 计,超限返回 429 并携带 Retry-After,按提示退避即可。

套餐速率说明
免费档60 RPM注册即得,适合验证与原型
标准档600 RPM按量付费,自动随用量提额
企业档专属独立通道与 SLA,按合同约定