Skip to Content

调试响应头

网关在 LLM 转发流程的响应中注入 X-Pipeline-* 头,帮助排查鉴权、限流、路由与适配各阶段的情况:

响应头含义
X-Pipeline-Auth鉴权结果与耗时,如 pass (3ms, tier=bronze) / fail (3ms)
X-Pipeline-RateLimit限流检查结果,如 pass (1ms) / fail (1ms, reason=qpm_exceeded)
X-Pipeline-Route路由结果,如 pass (1ms, DeepSeek→deepseek-v4-flash-0731) / fail (1ms)
X-Pipeline-Adapter上游适配阶段结果,如 done (250ms) / fail (250ms)
X-Pipeline-Breakdown转发各环节耗时分解,如 fwd=250 cost=5 deduct=5 record=1 bodies=1
curl -i https://api.inflox.ai/v1/chat/completions \ -H "Authorization: Bearer wk-xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx" \ -H "Content-Type: application/json" \ -d '{ "model": "{provider}/{model}", "messages": [{"role": "user", "content": "hi"}] }'

在响应头中查看上述 X-Pipeline-* 字段。

X-Pipeline-* 调试头只在 chat / messages / responses 的转发流程注入,GET /v1/models 等元数据接口不会返回。另外,即使 API Key 无效,鉴权失败时也会返回 X-Pipeline-Auth: fail