接入文档

3 分钟接入全栈大模型 · 完全兼容 OpenAI 协议

1快速开始

注册并登录控制台,创建 API 密钥,然后使用以下三个要素发起任意请求:

Base URLhttps://api.zhuohuo.cn/v1
API Keysk-xxxxx(控制台创建)
Modeldeepseek-v3.2-flash · qwen3.8-flash · glm-5.3-flash …
curl -X POST "https://api.zhuohuo.cn/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer sk-你的Key" \
  -d '{
    "model": "deepseek-v3.2-flash",
    "messages": [{"role": "user", "content": "你好"}],
    "stream": true
  }'

支持 stream 流式、tools 函数调用、prefix cache 前缀缓存(命中自动省钱)。

2常用工具配置

2.1 Cherry Studio

设置 → 模型服务 → OpenAI 兼容

API 地址: https://api.zhuohuo.cn/v1
API Key : sk-你的Key
模型    : deepseek-v3.2-flash(或任意已开通模型)

2.2 Cline / Roo Code

API Provider: OpenAI Compatible
Base URL    : https://api.zhuohuo.cn/v1
API Key     : sk-你的Key
Model ID    : deepseek-v3.2-flash

2.3 Claude Code

export ANTHROPIC_BASE_URL="https://api.zhuohuo.cn/v1"
export ANTHROPIC_AUTH_TOKEN="sk-你的Key"
export ANTHROPIC_MODEL="claude-sonnet-4.5"
export ANTHROPIC_SMALL_FAST_MODEL="claude-haiku-4.5"

2.4 Codex

export OPENAI_API_BASE="https://api.zhuohuo.cn/v1"
export OPENAI_API_KEY="sk-你的Key"
export OPENAI_MODEL="deepseek-v3.2-flash"

2.5 CC Switch / WorkBuddy

选择 OpenAI 兼容 Provider,填入 Base URL 与 Key 即可全局生效。

3API 端点

端点说明
POST /v1/chat/completions对话补全(流式/非流式)
POST /v1/responsesResponses API(兼容)
POST /v1/embeddings向量嵌入
GET /v1/models查询已开通模型列表
POST /v1/images/generations图像生成(按渠道开放)

4计费与额度

✔ 按量计费 · 实时扣费 · 前缀缓存命中半价

价格按模型展示在 模型广场。控制台实时查看余额、用量与消费明细;额度不足时自动返回 402,充值后立即恢复。

5常见问题

Q:一个 Key 可以调用所有模型吗?

可以。只需一个 Key,在请求中指定 model 即可切换到对应模型,无需为每个模型单独创建 Key。

Q:支持流式输出吗?

支持,设置 "stream": true 即可获得 SSE 流式响应,与官方 OpenAI SDK 完全一致。

Q:前缀缓存如何省钱?

相同的系统提示词/前缀会自动命中缓存,按缓存价计费(约为输入价的 1/10),长上下文场景省 50% 以上。

Q:额度用完了会怎么样?

返回 HTTP 402 错误,不会产生额外扣费;控制台充值后立即恢复服务。

Q:数据安全如何保证?

平台对全部请求做内容审核与传输加密(HTTPS),日志仅用于计费与故障排查,不用于模型训练。