Skip to content

Chat Completions

POST /v1/chat/completions 接受消息列表并生成回复,适合已有 OpenAI Chat Completions 集成。

最小请求

bash
curl --fail-with-body https://relay.withrpm.org/v1/chat/completions \
  -H "Authorization: Bearer $SPEEDYRPM_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "<MODEL_ID>",
    "messages": [
      {"role": "system", "content": "回答要简洁。"},
      {"role": "user", "content": "什么是 API 网关?"}
    ]
  }'

常用字段

字段必填说明
model/v1/models 返回的模型 ID
messages按顺序排列的消息数组
stream设为 true 时请求 SSE 流式输出
temperature部分模型支持的采样参数
max_tokens部分模型支持的输出长度上限

不同模型对可选字段的支持可能不同。如果收到参数错误,先保留 modelmessages 做最小请求。

流式请求

bash
curl --no-buffer --fail-with-body https://relay.withrpm.org/v1/chat/completions \
  -H "Authorization: Bearer $SPEEDYRPM_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "<MODEL_ID>",
    "stream": true,
    "messages": [{"role": "user", "content": "列出三个调试 API 的步骤"}]
  }'

工具调用

某些模型支持 tools 和工具调用响应。工具能力取决于模型和渠道;在生产使用前,应对目标模型做端到端验证,并对工具参数进行服务端校验。

OpenAI-compatible API gateway