跳转到内容
主站 新闻 控制台

Chat Completions

对话补全是最常用的接口,与 OpenAI 协议完全兼容。

POST https://api.4allapi.com/v1/chat/completions

请求参数

参数类型必填说明
modelstring模型名,见 模型总览
messagesarray对话消息数组,元素含 rolecontent
streamboolean是否流式返回,见 流式输出
temperaturenumber采样温度 0–2,越大越发散
top_pnumber核采样阈值,与 temperature 二选一调整
max_tokensnumber回复的最大 token 数
stopstring/array停止词
presence_penaltynumber话题新颖度惩罚 -2–2
frequency_penaltynumber重复度惩罚 -2–2
toolsarray工具/函数调用定义(支持的模型)
response_formatobject{"type":"json_object"} 强制 JSON 输出

messages 中的 role 支持 system / user / assistant / toolcontent 可以是字符串,也可以是多模态数组(文本 + 图片,见 视觉理解)。

请求示例

Terminal window
curl https://api.4allapi.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AIPROXY_KEY" \
-d '{
"model": "fable-5",
"messages": [
{"role": "system", "content": "你是一个严谨的技术助手"},
{"role": "user", "content": "用一句话解释什么是 API 网关"}
],
"temperature": 0.7,
"max_tokens": 512
}'

响应结构

{
"id": "chatcmpl-xxx",
"object": "chat.completion",
"created": 1750000000,
"model": "fable-5",
"choices": [
{
"index": 0,
"message": { "role": "assistant", "content": "API 网关是……" },
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 32,
"completion_tokens": 41,
"total_tokens": 73
}
}

usage 字段是计费依据,详见 计费与额度