理解服务状态
一次请求的结果同时受到客户端网络、密钥配置、模型可用性和上游服务状态影响。排查时应先确认本地可重复的问题,再判断是否为临时波动。
请求链路
| 环节 | 常见现象 | 优先检查 |
|---|---|---|
| 客户端 | 401、格式错误、连接失败 | Key、Base URL、SDK 配置 |
| 访问控制 | 429、模型不可见 | Key 状态、余额、并发与模型范围 |
| 上游 | 暂时失败、响应变慢 | 短请求复现、错误时间与模型 |
响应时间
首个响应时间可能会随模型负载、请求上下文长度、网络路径和上游排队变化。对比性能时请使用相同模型、相近上下文和相同客户端设置,避免用单次长请求得出结论。
出现异常时
- 用短请求确认是否能稳定复现。
- 保存状态码、模型、请求时间和已脱敏错误。
- 避免多线程持续重试。
- 持续异常时联系支持并提供上述信息。
维护原则
维护和升级以减少对现有用户调用的影响为前提。公开文档不披露上游账号、调度细节、内部网络或安全配置。
