Perplexity
Perplexity Sonar 提供以搜索结果为依据的模型,将语言模型响应与网页检索相结合。应用通过稳定的 AISIX 别名调用 Sonar,同时由网关保存 Perplexity 凭证。
准备工作
开始前,请准备以下内容:
- 一套 AISIX 环境:
- 对于 AISIX Cloud,需要一个已关联网关的环境和具有写入作用域的 Admin Token。对于 On-Premises,请按照 AISIX Cloud 快速入门操作。如需申请 Hybrid Cloud 访问权限,请联系 API7。
- 对于开源 AISIX 网关,请准备本地 AISIX 安装,或使用开源 AISIX 网关快速入门中的 Docker 配置。配置网关以加载声明式资源文件。
- 一个 Perplexity API Key。有关创建方法,请参阅 Perplexity 快速入门。
- 已安装
curl和jq。
使用 AISIX Cloud 配置
导出 AISIX Cloud 连接信息:
# AISIX_CP 是 Admin API 基础 URL;应包含 /api,且末尾不带斜杠
# 本地 On-Premises 快速入门使用 http://localhost:8080/api
export AISIX_CP="YOUR_AISIX_CLOUD_ADMIN_API_URL"
export AISIX_TOKEN="YOUR_ADMIN_TOKEN"
export ENV_ID="YOUR_ENVIRONMENT_ID"
为 Perplexity 支持的 Chat Completions 路由创建服务提供方密钥、模型别名和调用方 API Key。
由于 Perplexity 提供 OpenAI 兼容的 Chat Completions API,AISIX 会通过 openai 适配器连接,并将 Perplexity API Root 用作 api_base。AISIX 不会注册 Perplexity 特定的请求或响应重写。
创建服务提供方密钥
创建用于保存 Perplexity 凭证和 API Root 的服务提供方密钥:
# 请替换为实际值
export PERPLEXITY_API_KEY="YOUR_PROVIDER_API_KEY"
PROVIDER_KEY_ID=$(curl -sS -X POST "$AISIX_CP/provider_keys" \
-H "Authorization: Bearer $AISIX_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"display_name": "perplexity-prod",
"provider": "perplexity",
"api_key": "'"${PERPLEXITY_API_KEY}"'",
"api_base": "https://api.perplexity.ai",
"allowed_environments": ["'"${ENV_ID}"'"]
}' | jq -r '.provider_key.id')
echo "$PROVIDER_KEY_ID"
❶ provider 为 perplexity。AISIX Cloud Admin API 会从目录服务提供方派生适配器;adapter 字段仅适用于 BYO 服务提供方密钥。
❷ api_key 保存 Perplexity API Key。该值遵循服务提供方密钥中的凭证处理行为。
❸ api_base 是裸主机 https://api.perplexity.ai,即 Perplexity 文档为 OpenAI SDK 客户端提供的 Base URL。其 OpenAI 兼容 Chat Completions 路由位于 /chat/completions,不包含版本片段,因此 Base 不带版本后缀。AISIX 会追加端点路径,生成 https://api.perplexity.ai/chat/completions。
对于此服务提供方,api_base 可选。省略时,AISIX Cloud Admin API 会填入 https://api.perplexity.ai。显式设置可让上游 Root 在资源中清晰可见。该值绝不能最终为空:对于 openai 以外使用 openai 适配器的服务提供方,AISIX 不会回退到 api.openai.com,而是返回上游配置错误,因此 Perplexity 凭证不会发送到公共 OpenAI 主机。
AISIX 会移除 api_base 末尾的端点片段,因此粘贴文档中的完整端点 URL https://api.perplexity.ai/chat/completions 后仍会解析为相同 Base。尾部斜杠也会被移除。
该命令会把返回的服务提供方密钥 ID 保存到 PROVIDER_KEY_ID。
创建模型
Perplexity 模型 ID 表示搜索 层级,而不是参数数量或发布日期。它们是不带厂商命名空间和日期快照后缀的裸名称:sonar 用于快速生成有依据的回答,sonar-pro 用于更广泛的检索和更强的综合分析,sonar-reasoning-pro 用于带引用的多步推理,sonar-deep-research 用于耗时较长的研究报告。
创建调用方将在请求中发送的模型别名:
MODEL_ID=$(curl -sS -X POST "$AISIX_CP/environments/$ENV_ID/models" \
-H "Authorization: Bearer $AISIX_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"display_name": "perplexity-sonar-pro-prod",
"model_name": "sonar-pro",
"provider_key_id": "'"${PROVIDER_KEY_ID}"'"
}' | jq -r '.model.id')
echo "$MODEL_ID"
❶ display_name 是调用方在 model 中发送的别名。
❷ model_name 是 Perplexity 模型 ID,例如 sonar-pro 或 sonar。
❸ provider_key_id 将该别名关联到 Perplexity 服务提供方密钥。
创建调用方 API Key
创建可访问该模型别名的调用方 API Key。密钥值由网关生成;明文仅在创建响应中返回一次,因此请立即保存:
AISIX_API_KEY=$(curl -sS -X POST "$AISIX_CP/environments/$ENV_ID/api_keys" \
-H "Authorization: Bearer $AISIX_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"display_name": "perplexity-caller",
"allowed_models": ["'"${MODEL_ID}"'"]
}' | jq -r '.plaintext')
echo "$AISIX_API_KEY"
allowed_models 值通过模型 ID 引用模型,因此该密钥只能访问你创建的别名。写入后,配置会自动投射到关联的网关。
使用开源 AISIX 网关配置
导出上游凭证,并选择应用将发送给网关的调用方 API Key:
export PERPLEXITY_API_KEY="YOUR_PROVIDER_API_KEY"
export CALLER_API_KEY="YOUR_CALLER_API_KEY"
为该服务提供方创建完整的声明式资源文件:
_format_version: "1"
provider_keys:
- display_name: "perplexity-prod"
provider: "perplexity"
adapter: "openai"
api_key: ${PERPLEXITY_API_KEY}
api_base: "https://api.perplexity.ai"
models:
- display_name: "perplexity-sonar-pro-prod"
provider: "perplexity"
model_name: "sonar-pro"
provider_key: "perplexity-prod"
api_keys:
- display_name: "perplexity-caller"
key_env: CALLER_API_KEY
allowed_models:
- "perplexity-sonar-pro-prod"
如果 AISIX 安装在本地,请在加载前验证文件:
aisix validate --resources resources.yaml
验证后,在网关进程环境中提供文件引用的环境变量,再启动网关。仅当这些变量已经可供进程使用时,才重新加载现有网关;否则,请使用更新后的环境重启网关。
如果使用 Docker,请调整开源 AISIX 网关快速入门中的验证和启动命令。挂载此 resources.yaml 文件,并在两条命令中使用 -e 传入它引用的每个环境变量。资源加载后,准备下文共用的验证请求:
export AISIX_API_KEY="$CALLER_API_KEY"
验证服务提供方连接
导出 AISIX 网关 Origin:
# 本地快速入门使用 http://127.0.0.1:3000
export AISIX_PROXY="YOUR_AISIX_GATEWAY_ORIGIN"
通过 AISIX 代理发送 Chat Completions 请求。Sonar 会根据实时网页搜索生成回答,因此请提出一个需要当前信息的问题:
curl -sS -X POST "$AISIX_PROXY/v1/chat/completions" \
-H "Authorization: Bearer ${AISIX_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "perplexity-sonar-pro-prod",
"messages": [
{
"role": "user",
"content": "Summarize the latest news about AI gateways in two sentences."
}
]
}'
网关返回 OpenAI 兼容响应,其中会回显调用方面向的别名 perplexity-sonar-pro-prod。如果请求失败,请检查服务提供方密钥的 api_key、api_base,以及 model_name 中的 Perplexity 模型 ID。
获取搜索引用
Sonar 响应在 Perplexity 响应体顶层的 citations 和 search_results 中携带来源,这两个字段与 choices 同级。它们是 Perplexity 扩展,而不是 OpenAI Chat Completions 格式的一部分。AISIX 会将 Chat Completions 响应标准化为规范的 OpenAI 格式,因此通过 /v1/chat/completions 时,这两个字段不会到达调用方。
当应用需要来源列表时,请改为调用服务提供方原生路由。AISIX 会原样转发请求体,注入服务提供方密钥作为上游身份认证,并不加修改地返回上游响应:
curl -sS -X POST "$AISIX_PROXY/passthrough/perplexity/chat/completions" \
-H "Authorization: Bearer ${AISIX_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "sonar-pro",
"messages": [
{
"role": "user",
"content": "Summarize the latest news about AI gateways in two sentences."
}
]
}'
perplexity 路径片段是服务提供方值,而不是别名;请求体携带上游模型 ID sonar-pro,而不是别名。AISIX 仍会认证调用方密钥,并要求该密钥获准访问服务提供方为 perplexity 的模型。
透传是原始隧道,不会解析响应体,因此生成的用量事件会记录零个输入和输出 Token。通过这种方式发送的请求会出现在日志中,但不计入基于 Token 的成本核算或预算。需要计量的流量应使用 /v1/chat/completions,仅将透传用于需要引用载荷的调用。请参阅服务提供方透传。
设置推理强度
sonar-reasoning-pro 和 sonar-deep-research 接受 reasoning_effort 字段,其值可为 minimal、low、medium 和 high。有关每个级别的具体变化,请参阅 Perplexity Sonar Reasoning Pro 参考。
AISIX 会将其未建模的请求字段不加修改地转发到上游,因此请将该字段添加到 Chat Completions 请求体。以下示例假设已创建第二个别名 perplexity-sonar-reasoning-prod,且其 model_name 设置为 sonar-reasoning-pro:
{
"model": "perplexity-sonar-reasoning-prod",
"messages": [{ "role": "user", "content": "Compare the two proposals." }],
"reasoning_effort": "high"
}
AISIX 未为 Perplexity 注册 response.reasoning_field 映射,因此不会将 Perplexity 特定的推理字段提升到规范的 reasoning_content 位置。无论 Perplexity 将推理输出放在标准响应内容的哪个位置,都会原样到达调用方。如果未来某个 Perplexity 模型在独立的 delta 路径上流式返回推理内容,请在服务提供方密钥上设置 response.reasoning_field。
端点和成本边界
Perplexity 发布的模型目录仅支持 Chat,这限制了 Perplexity 别名可提供服务的代理路由:
| 路由 | 使用 Perplexity 别名时的行为 |
|---|---|
/v1/chat/completions | 支持,包括 stream: true。 |
/v1/responses | 通过 Chat 适配器路径上的 Responses 桥接支持。 |
/v1/embeddings | openai 适配器会转发请求格式,但 Perplexity 未发布 Embedding 模型,因此没有可作为目标的上游模型。 |
/v1/images/generations | 不支持。该路由仅接受所配置服务提供方为 openai 的模型。 |
/v1/rerank | 不支持。该路由的允许列表为 openai、cohere 和 jina。 |
/v1/videos | 不支持。该路由的允许列表中不包含 perplexity。 |
/passthrough/perplexity/*rest | 支持。用于服务提供方原生的请求和响应格式。 |
另有两个边界会影响 Perplexity 流量的建模方式:
- 当前所有 Sonar 模型均未记录支持工具调用。请 将函数调用工作负载路由到其他别名。
- AISIX 成本元数据以每 1,000 个输入和输出 Token 的 USD 金额表示。除了提示词和补全 Token 外,Perplexity 还按请求、引用和推理 Token 对
sonar-deep-research计费,因此仅按 Token 估算会低估该模型的实际支出。请将网关中sonar-deep-research的成本数据视为下限,并与 Perplexity 账单核对。
后续步骤
你已将 AISIX 连接到 Perplexity,并验证了模型别名。接下来可阅读以下指南:
- 模型别名:为该别名配置路由、重试行为或成本元数据。
- 路由与故障转移:在 Perplexity 与另一个服务提供方之间执行故障转移。
- 服务提供方特定覆盖项:当上游 API 与其适配器不同时,调整请求和响应形态。
- 服务提供方兼容性:查看支持的代理端点和服务提供方特定边界。