接口文档

所有接口兼容 OpenAI 协议。支持流式以外的全部常用参数。

鉴权方式

在控制台创建密钥,请求时放在 Header 里:

Authorization: Bearer sk-xxxxxxxx

密钥泄露可随时在控制台吊销,不影响其他密钥。

对话补全

POST /v1/chat/completions —— 按 token 计费

curl https://你的域名/v1/chat/completions \
  -H "Authorization: Bearer sk-你的密钥" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3:8b",
    "messages": [{"role": "user", "content": "用一句话介绍你自己"}]
  }'

响应示例

{
  "id": "chatcmpl-xxxx",
  "object": "chat.completion",
  "model": "qwen3:8b",
  "choices": [{
    "index": 0,
    "message": {"role": "assistant", "content": "..."},
    "finish_reason": "stop"
  }],
  "usage": {
    "prompt_tokens": 12,
    "completion_tokens": 48,
    "total_tokens": 60,
    "credits_charged": 6
  }
}

文本摘要(任务类接口)

POST /v1/tasks/summarize —— 按次计费,每次固定 50 额度

curl https://你的域名/v1/tasks/summarize \
  -H "Authorization: Bearer sk-你的密钥" \
  -H "Content-Type: application/json" \
  -d '{"text": "这里放很长的原文..."}'

这类接口是示例:你后续任何脚本能力都能用同样方式挂上来按次售卖。

模型列表

GET /v1/models —— 查看当前可用模型

计费与错误码

状态码含义处理建议
200成功
401密钥无效或缺失检查 Authorization 头
402额度不足到控制台充值
429请求过于频繁降低并发或稍后重试
502推理服务异常稍后重试,不扣费

计费标准:每 1,000 tokens(输入+输出)消耗 100 额度。失败请求不扣费。

本地推理 · 数据不出境 · 按量计费