支持的端点
AISIX 会暴露应用团队已经熟悉的代理端点。选择服务提供方、模型别名或流量策略前,可以先从本页确认客户端应该调用哪一种 API 形态。
如需为编码工具和应用框架配置客户 端,请参阅集成指南。
主要 API 类型
| API 类型 | 路由 | 适用场景 |
|---|---|---|
| 聊天补全 | POST /v1/chat/completions | 兼容 OpenAI 的聊天请求、流式聊天、工具调用、路由模型和合议模型。 |
| Anthropic Messages | POST /v1/messages、POST /v1/messages/count_tokens | Anthropic 风格消息请求,以及面向 Anthropic 后端模型的 Token 计数。 |
| Responses | POST /v1/responses | Responses API 客户端,以及跨服务提供方的 Agent 风格响应流程。 |
| 文本补全 | POST /v1/completions | 兼容 OpenAI 的旧版文本补全客户端。 |
| 向量嵌入 | POST /v1/embeddings | 通过支持的服务提供方生成向量嵌入。 |
| 重排序 | POST /v1/rerank | 通过支持的服务提供方对文档进行重排序。 |
| 图像生成 | POST /v1/images/generations | 文生图请求。 |
| 语音与音频 | POST /v1/audio/transcriptions、POST /v1/audio/translations、POST /v1/audio/speech | 语音转文字、翻译和文字转 语音请求。 |
| Batch、Files 与 Fine-tuning | POST /v1/files、POST /v1/batches、POST /v1/fine_tuning/jobs 及其查询、列表、取消和内容读取路由 | 兼容 OpenAI 的批处理、文件管理和微调任务,由网关管理服务提供方路由。 |
| Realtime | GET /v1/realtime(WebSocket) | 通过 WebSocket 转发 OpenAI Realtime 客户端请求,并跟踪会话用量。 |
| 服务提供方透传 | ANY /passthrough/:provider/*rest | 需要使用 AISIX 认证和配额检查,但不希望 AISIX 规范化请求体的服务提供方专属调用。 |
| MCP 网关 | ANY /mcp | 通过已注册的上游 MCP 服务器执行 Agent 工具调用,并按调用方 API Key 控制工具访问。 |
发现与健康检查
| 端点 | 适用场景 |
|---|---|
GET /v1/models | 返回当前调用方 API Key 可访问的模型别名。客户端需要发现网关侧模型名时使用。 |
GET /livez | 检查代理监听端是否存活。用于代理监听端健康检查,不代表模型或服务提供方就绪。 |
GET /readyz | 检查实例是否应该接收流量。实例正在启动、排空或配置监听过期时返回 503。 |