调试响应头
网关在 LLM 转发流程的响应中注入 X-Pipeline-* 头,帮助排查鉴权、限流、路由与适配各阶段的情况:
| 响应头 | 含义 |
|---|---|
X-Pipeline-Auth | 鉴权结果与耗时,如 pass (3ms, tier=bronze) / fail (3ms) |
X-Pipeline-RateLimit | 限流检查结果,如 pass (1ms) / fail (1ms, reason=qpm_exceeded) |
X-Pipeline-Route | 路由结果,如 pass (1ms, DeepSeek→deepseek-v4-flash-0731) / fail (1ms) |
X-Pipeline-Adapter | 上游适配阶段结果,如 done (250ms) / fail (250ms) |
X-Pipeline-Breakdown | 转发各环节耗时分解,如 fwd=250 cost=5 deduct=5 record=1 bodies=1 |
curl -i https://api.inflox.ai/v1/chat/completions \
-H "Authorization: Bearer wk-xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx" \
-H "Content-Type: application/json" \
-d '{
"model": "{provider}/{model}",
"messages": [{"role": "user", "content": "hi"}]
}'在响应头中查看上述 X-Pipeline-* 字段。
X-Pipeline-* 调试头只在 chat / messages / responses 的转发流程注入,GET /v1/models 等元数据接口不会返回。另外,即使 API Key 无效,鉴权失败时也会返回 X-Pipeline-Auth: fail。