跳到主要内容

资源模型

AISIX AI 网关通过一组精简资源,将调用方请求转换为已完成上游认证的服务提供方请求。

核心资源包括调用方 API Key、模型和服务提供方密钥。当你需要目标选择、响应合成、限流、安全护栏、缓存、可观测性或托管预算检查时,可以在这条链路上继续叠加虚拟模型形态和策略资源。

资源关系

对于单目标模型,核心资源之间的关系如下:

调用方 API Key 用于认证客户端并控制模型访问权限。模型资源定义客户端发送的模型别名,引用 AISIX 调用上游时使用的服务提供方密钥,并保存上游模型 ID。服务提供方密钥则保存上游凭证、base URL、服务提供方标签和适配器设置。

开源 AISIX 网关快速入门中,调用方 API Key 是 YOUR_CALLER_API_KEY,模型别名是 gpt-4o-mini,模型服务提供方密钥保存 OpenAI 凭证,上游模型同样是 gpt-4o-mini

在生产环境中,别名和上游模型不必相同。例如,应用可以持续发送 prod-chat,而网关在该别名背后切换上游模型、服务提供方密钥或路由策略。

核心流量资源

大多数 AISIX 流量都从三个资源开始:调用方 API Key、模型和服务提供方密钥。它们共同决定谁可以调用网关、调用方可以使用哪个模型别名,以及 AISIX 会调用哪个上游服务提供方。

调用方 API Key

调用方 API Key 是应用调用 AISIX 时使用的网关凭证。

该密钥用于认证调用方,并控制调用方可以使用哪些模型别名。关于密钥哈希、轮换和模型允许列表,请参见调用方 API Key

模型

模型是调用方在请求体中发送的、面向网关的模型别名。

对于直接模型,面向调用方的别名可以不同于上游服务提供方的模型 ID。模型还会指向 AISIX 调用上游时应使用的服务提供方密钥。虚拟模型会先通过路由、语义或合议决策解析别名,再到达直接模型。

有关各模型形态及其配置,请参阅模型别名

服务提供方密钥

服务提供方密钥保存 AISIX 解析模型后用于访问上游的凭证和连接设置。

服务提供方密钥可以让上游凭证不进入应用代码,并允许多个模型复用同一个上游账号、base URL 和适配器族。关于凭证字段、base URL 行为、服务提供方标签和适配器,请参见服务提供方凭证

模型分发形态

每个模型都有 display_name,它是调用方和其他模型资源使用的别名。其余字段定义一种分发形态:

形态资源关系
直接模型存储上游 model_name,并引用一个服务提供方密钥。
路由模型引用多个直接目标别名,并按路由策略选择一个目标。
语义模型引用一个支持向量嵌入的直接模型、一个默认直接模型,以及语义路由对应的直接目标。
合议模型引用直接合议成员模型和一个直接评审模型。

四种形态互斥。资源不能将直接上游字段与 routingsemanticensemble 块组合使用。

向量嵌入模型仍是直接模型。其 embedding 块记录向量维度和归一化行为,使该模型能够提供向量嵌入并支持语义路由。

调用方可以继续使用一个稳定别名,运维人员则可以更改别名背后的直接上游、路由目标、语义路由或合议成员。调用方 API Key 必须允许请求中指定的别名;AISIX 会在内部选择或调用被引用的模型。

有关详细行为,请参阅路由与故障转移语义路由合议模型

策略资源

策略资源会围绕调用方 API Key、模型和服务提供方密钥组成的链路添加网关行为。

限流用于控制请求速率和并发。安全护栏用于检查请求或响应内容。缓存可以复用 Chat Completions 响应。可观测性导出器会将网关请求遥测发送到 OTLP/HTTP、对象存储、阿里云 SLS 或 Datadog 目的地。

预算检查通过 AISIX Cloud 托管策略执行。自托管网关不会暴露本地预算资源。