聊天补全
2026/7/28大约 1 分钟
聊天补全 (Chat Completions)
创建聊天补全,与 OpenAI 的 Chat Completions API 完全兼容。
接口信息
- URL:
/v1/chat/completions - 方法: POST
- 认证: 需要 API Key
请求参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 模型 ID,如 gpt-4o-mini |
messages | array | 是 | 消息列表 |
temperature | number | 否 | 温度参数,0-2,默认 1 |
max_tokens | integer | 否 | 最大生成 token 数 |
top_p | number | 否 | 核采样参数,0-1 |
frequency_penalty | number | 否 | 频率惩罚,-2 到 2 |
presence_penalty | number | 否 | 存在惩罚,-2 到 2 |
stream | boolean | 否 | 是否流式输出,默认 false |
stop | array | 否 | 停止词列表 |
n | integer | 否 | 生成数量,默认 1 |
messages 格式
{
"messages": [
{"role": "system", "content": "你是一个有用的助手"},
{"role": "user", "content": "你好"},
{"role": "assistant", "content": "你好!有什么可以帮助你的吗?"},
{"role": "user", "content": "今天天气怎么样?"}
]
}请求示例
普通请求
curl https://api.quickapi.store/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "gpt-4o-mini",
"messages": [
{"role": "user", "content": "你好"}
],
"temperature": 0.7,
"max_tokens": 1000
}'流式请求
curl https://api.quickapi.store/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "gpt-4o-mini",
"messages": [
{"role": "user", "content": "你好"}
],
"stream": true
}'响应示例
普通响应
{
"id": "chatcmpl-xxx",
"object": "chat.completion",
"created": 1700000000,
"model": "gpt-4o-mini",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "你好!有什么可以帮助你的吗?"
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 10,
"completion_tokens": 20,
"total_tokens": 30
}
}流式响应
data: {"id":"chatcmpl-xxx","object":"chat.completion.chunk","created":1700000000,"model":"gpt-4o-mini","choices":[{"index":0,"delta":{"content":"你好"},"finish_reason":null}]}
data: {"id":"chatcmpl-xxx","object":"chat.completion.chunk","created":1700000000,"model":"gpt-4o-mini","choices":[{"index":0,"delta":{"content":"!"},"finish_reason":null}]}
data: [DONE]Python 示例
from openai import OpenAI
client = OpenAI(
base_url="https://api.quickapi.store/v1",
api_key="YOUR_API_KEY"
)
# 普通请求
response = client.chat.completions.create(
model="gpt-4o-mini",
messages=[{"role": "user", "content": "你好"}]
)
print(response.choices[0].message.content)
# 流式请求
for chunk in client.chat.completions.create(
model="gpt-4o-mini",
messages=[{"role": "user", "content": "你好"}],
stream=True
):
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end="")
