使用方法
本服务提供 OpenAI 兼容的 Chat Completions 接口,可直接对接 Cherry Studio、Cline、Open WebUI 等客户端,或使用任意语言的 OpenAI SDK 调用。调用前请先在「Token 管理」添加 Token、在「API Keys」创建 Key;调用时 model 参数直接填写具体模型 id(如 deepseek-v4-flash),支持列表见 GET /v1/models。
局域网访问:服务监听
0.0.0.0,局域网内其他设备可将下方示例中的 localhost 替换为本机局域网 IP(如 192.168.1.10)进行调用。接口地址
/v1/chat/completions
请求方法
POST
鉴权方式
Bearer <API Key>
模型参数
model = "<具体模型 id>"(如 deepseek-v4-flash)
注意事项
model 填具体模型 id:
model=auto 已不再支持。请直接填写支持的模型 id(如 deepseek-v4-flash / qwen3.5-flash / glm-5.2 / mimo-v2.5-pro / agnes-2.5-flash),完整列表见 GET /v1/models;填写未知模型会返回 400。无并发/频率限制:同一供应商的并发请求自动轮询其全部有效 Token;单个 Token 冷却
1 分钟,轮询会跳过冷却中的 Token,全部冷却时退化为使用最久未用的 Token(不阻塞请求)。多备 Token 降低风控风险:并发请求会轮询使用不同 Token。若 Token 太少,多个并发请求会集中打到同一上游 Token,极易触发风控导致封号。建议每个供应商配置多个有效 Token。
流式输出:设置
"stream": true 启用 SSE 流式响应;模型思考过程会通过 reasoning_content 字段返回。对接客户端:在 Cherry Studio / Cline / Open WebUI 等客户端中,将 API 地址填为下方示例的
base_url,API Key 填创建的 Key,模型填任意支持的模型 id(如 deepseek-v4-flash)即可。API Keys
| 标签 | Key | 创建时间 | 操作 |
|---|
还没有 API Key,点击上方按钮生成一个
Token 管理
点击各供应商的「添加 Token」按钮即可添加,添加后会自动验证,验证不通过则不会保存
用量统计
昨日调用
-
7 日调用
-
30 日调用
-
| 时间 | 供应商 | 模型 | Token | 激活码 | 状态 | 响应时长 | 失败原因 |
|---|
暂无用量数据
激活码管理
搜索激活码查看状态与激活记录
激活码通道软件配置
按软件(客户端请求头 X-Software-Name)配置激活码通道的默认模型与思考开关:请求按软件名精确匹配配置,未配置的软件将无法调用(返回 400),请为每个客户端软件单独添加。预置软件行为预留客户端,留空不配置即不可用。