AI API 网关
AI API 网关将不同上游模型服务聚合为一个统一入口,并在请求到达提供商前执行鉴权、模型选择、路由和用量治理。
它解决什么问题
不同模型提供商的认证方式、地址、请求格式、限额和计价规则并不相同。网关将这些差异收敛在服务端,让应用侧可以围绕一个基础地址和一组 API Key 集成。
网关并不等同于模型提供商。它负责选择和调用已配置的上游;某个模型能否使用仍取决于当前部署的通道、权限、余额和策略。
- 统一入口:调用方不需要为每个上游维护不同的域名与密钥。
- 协议适配:在支持的范围内将兼容请求转换为上游所需格式。
- 治理控制:在转发前执行鉴权、限流、配额与路由判断。
一次请求如何流转
请求先到达公开 API 路径。身份校验通过后,系统根据模型、用户分组、令牌限制与通道状态筛选候选通道,再按配置的优先级、权重和重试规则处理。
上游响应会被转换回对调用方约定的响应形式;用量与日志则用于后续结算、审计和运维观察。这个流程使应用侧与上游变化保持相对解耦。
使用边界
公开价格页和模型页反映的是当前部署公开展示的信息。不要把知识库中的概念说明理解为某一模型、价格或服务等级的永久承诺。
将网关接入生产环境前,应分别验证目标模型、鉴权方式、流式响应、超时策略以及账户或 Key 的配额限制。