请求吞吐量趋势
响应状态码分布
「调用状态」来源于实际代理请求结果。点击 仅验证 Key 鉴权有效性,不代表模型可正常调用。
服务基础信息
| Base URL | — | |
| API Key | Bearer <your_proxy_api_key> |
Python SDK
cURL
超时配置
用于 Embedding / Reranker 等快速接口
推理模型 (DeepSeek-R1 等) 需要较长思考时间
Chat 快速模式
自动禁用推理思考、强制非流式、使用短超时。单次请求从 30-60s 降至 2-5s
调度参数
开启后调度器会根据历史延迟自动排序候选节点(快的优先)。关闭时严格按照界面配置的顺序调用