理解服务状态

一次请求的结果同时受到客户端网络、密钥配置、模型可用性和上游服务状态影响。排查时应先确认本地可重复的问题,再判断是否为临时波动。

请求链路

环节常见现象优先检查
客户端401、格式错误、连接失败Key、Base URL、SDK 配置
访问控制429、模型不可见Key 状态、余额、并发与模型范围
上游暂时失败、响应变慢短请求复现、错误时间与模型

响应时间

首个响应时间可能会随模型负载、请求上下文长度、网络路径和上游排队变化。对比性能时请使用相同模型、相近上下文和相同客户端设置,避免用单次长请求得出结论。

出现异常时

  1. 用短请求确认是否能稳定复现。
  2. 保存状态码、模型、请求时间和已脱敏错误。
  3. 避免多线程持续重试。
  4. 持续异常时联系支持并提供上述信息。

维护原则

维护和升级以减少对现有用户调用的影响为前提。公开文档不披露上游账号、调度细节、内部网络或安全配置。