私库云 - 开发文档
后台使用
复制页面
开始使用
入门指南
模型价格
工具接入
工具接入总览
CC Switch 配置
Codex 配置
Claude Code 配置
OpenCode 配置
OpenClaw 配置
Hermes 配置
开发者 API
API 调用说明
后台使用
账户用量与计费
渠道可用状态
常见问题
问题排查
合作咨询
合作需求提交
后台使用
复制页面
渠道可用状态
渠道状态
#
渠道状态用于展示已配置监控范围的探测结果或真实请求聚合结果。它反映的是指定平台、分组、模型和请求方式下的观测情况,不等同于分组整体可用,也不保证下一次业务请求一定成功。
监控范围
#
渠道状态只统计已经纳入监控的渠道、分组和模型。页面上的状态会受到模型、请 求接口、请求模式、统计窗口和监控模式影响。
因此,渠道状态适合用来快速发现趋势和异常,不能替代对目标模型发起一次完整的真实业务请求。
两种监控模式
#
V1 主动探测
#
V1 会按监控配置定期向上游发送检查请求,使用配置的模型、接口模式、请求模板和请求头。
正常:请求成功、HTTP 状态为 2xx、返回内容有效,且完整响应耗时低于 6 秒。
降级:请求成功,但完整响应耗时达到 6 秒或更久。
失败:请求返回 2xx,但内容为空或内容检查未通过。
错误:网络错误、超时、非 2xx 响应或其他执行错误。
端点 PING 只作为网络连接的辅助指标,不会单独决定主请求状态。
V2 被动监控
#
V2 不额外发送探测请求,而是聚合真实业务请求,按平台、分组和模型展示趋势。可查看 90 分钟、24 小时、7 天和 30 天窗口。
V2 健康分由错误率、首 Token 延迟(TTFT)和缓存率组成。默认最小样本数为 50;样本不足时显示“未知”,不会强行判断健康状态。
色块指标
#
V1 时间线
#
色块
含义
绿色、高
正常(operational):检查成功且响应耗时低于 6 秒
黄色、中
降级(degraded):检查成功,但响应耗时达到 6 秒
红色、低
失败或错误(failed /error)
灰色、短
该时间段没有检查记录
V2 色块矩阵
#
V2 色块表示健康分,而不是并发数:
绿色:健康分 80 分及以上;
黄色:健康分 50~79 分,需要关注;
红色:健康分低于 50 分,表示异常;
灰色:没有流量或样本不足,无法评分。
颜色不能直接说明“并发高”或“渠道不可用”。
应结合错误原因和实际请求结果判断。
状态枚举
#
V1 探测状态
#
正常(operational):请求成功、返回内容有效,且响应耗时低于 6 秒。
降级(degraded):请求成功,但响应耗时达到 6 秒或更久;降级仍计入可用检查。
失败(failed):请求返回 2xx,但内容为空或内容检查未通过。
错误(error):网络、超时、非 2xx 或其他执行错误。
V2 健康状态
#
健康(healthy):健康分 80 分及以上。
需关注(warning):健康分 50~79 分。
异常(critical):健康分低于 50 分。
未知(unknown):样本不足或当前统计窗口没有有效数据。
可用率
#
V1 可用率按统计窗口计算:
可用率 = (正常检查数 + 降级检查数) ÷ 总检查数 × 100%
页面提供近 7 天、15 天和 30 天窗口。失败和错误不计入可用检查;没有历史记录时显示-,不应将其当作 0% 可用率。
V2 使用真实请求的成功率和错误率展示业务流量质量:
成功率 = 1 - 错误率
V2 成功率与 V1 探测可用率的采样来源不同,不能直接横向比较。
延迟
#
V1
#
对话延迟:一次模型探测请求从发出到完整响应读取结束的耗时,单位为毫秒。
端点 PING:对端点来源地址发起 HEAD 请求的往返耗时,只用于观察网络连接,不能代表模型生成耗时。
V2
#
V2 主要展示真实请求的首 Token 延迟(TTFT)和请求时长,通常以 AVG、P50、P90等统计值呈现。TTFT 越高,用户等待首个输出的时间越长。
如何判断“好用”
#
1.
确认监控使用的模型、接口和请求模式与实际业务配置一致。
2.
查看最近状态、可用率、错误原因和延迟趋势,而不是只看一个颜色。
3.
使用实际业务请求验证完整链路:鉴权、首Token、流式传输、完整响应和计费均正常。
4.
若出现余额、权限、模型不支持、限流、账号池不可用或上游错误,应按错误原因处理。
下一步
#
开始配置:查看
工具接入
。
了解接口调用:查看
API 调用说明
。
余额或权限异常:查看
问题排查
。
上一页
账户用量与计费
下一页
问题排查