Chat Completions
POST /v1/chat/completions 接受消息列表并生成回复,适合已有 OpenAI Chat Completions 集成。
最小请求
bash
curl --fail-with-body https://relay.withrpm.org/v1/chat/completions \
-H "Authorization: Bearer $SPEEDYRPM_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "<MODEL_ID>",
"messages": [
{"role": "system", "content": "回答要简洁。"},
{"role": "user", "content": "什么是 API 网关?"}
]
}'常用字段
| 字段 | 必填 | 说明 |
|---|---|---|
model | 是 | /v1/models 返回的模型 ID |
messages | 是 | 按顺序排列的消息数组 |
stream | 否 | 设为 true 时请求 SSE 流式输出 |
temperature | 否 | 部分模型支持的采样参数 |
max_tokens | 否 | 部分模型支持的输出长度上限 |
不同模型对可选字段的支持可能不同。如果收到参数错误,先保留 model 与 messages 做最小请求。
流式请求
bash
curl --no-buffer --fail-with-body https://relay.withrpm.org/v1/chat/completions \
-H "Authorization: Bearer $SPEEDYRPM_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "<MODEL_ID>",
"stream": true,
"messages": [{"role": "user", "content": "列出三个调试 API 的步骤"}]
}'工具调用
某些模型支持 tools 和工具调用响应。工具能力取决于模型和渠道;在生产使用前,应对目标模型做端到端验证,并对工具参数进行服务端校验。