在 AI 网关链路里,路由转发只是第一层问题,真正容易被忽视的是模型身份校验。XTokenChecker 的定位就是验证 AI 网关中的模型身份:当网关把某个请求路由到上游模型服务时,它要确认这个上游确实是被登记且期望调用的大模型,而不是一个只改了响应里model字段的替身。这个问题在统一 API 层、企业模型网关、模型灰度发布和第三方模型转售场景里都会出现。下面从模型身份丢失的几个典型场景讲起,再给出一个基于签名令牌的最小校验实现,最后把 AI 网关常见的 502 错误放到同一套链路里一起排查。目标很明确:读完能动手搭出校验链路,也能在线上看到 502 时按顺序定位问题。
1. AI 网关为什么需要单独的“模型身份校验”
1.1 模型声明与实际响应可能不一致
在网关场景中,客户端调用POST /v1/chat/completions,请求体里通常带model字段。网关根据这个字段把请求转发给上游。问题在于:从客户端到真实模型之间存在多个信任边界。
第一类风险是第三方中转。