Batch、Files 与 Fine-tuning
AISIX AI 网关将兼容 OpenAI 的 Files、Batch 和 Fine-tuning API 作为一等代理路由暴露。客户端继续使用标准 OpenAI SDK 调用,由网关负责调用方认证、服务提供方凭证和已完成批处理的用量归因。
本指南将演示如何上传批处理输入文件、创建和跟踪批处理任务,并了解网关如何把每次调用路由到正确的服务提供方。
支持的代理路由
| 类型 | 路由 |
|---|---|
| Files | POST /v1/files、GET /v1/files、GET /v1/files/{id}、DELETE /v1/files/{id}、GET /v1/files/{id}/content |
| Batch | POST /v1/batches、GET /v1/batches、GET /v1/batches/{id}、POST /v1/batches/{id}/cancel |
| Fine-tuning | POST /v1/fine_tuning/jobs、GET /v1/fine_tuning/jobs、GET /v1/fine_tuning/jobs/{id}、POST /v1/fine_tuning/jobs/{id}/cancel |
目前支持兼容 OpenAI 的服务提供方(适配器为 openai,包括自定义 api_base 部署)和 Azure OpenAI(适配器为 azure-openai,使用资源作用域路由和 api-key 认证)。Vertex AI、Bedrock 和 Anthropic 原生批处理流程使用不同的传输协议和存储模型,暂不通过这些路由提供。
前提条件
开始前请准备:
- 一个可处理代理请求的 AISIX 网关。
- 一个可访问目标模型别名的调用方 API Key。
- 一个由兼容 OpenAI 或 Azure OpenAI 服务提供方支持的模型别名。