Chat Completions
对话补全是最常用的接口,与 OpenAI 协议完全兼容。
POST https://api.4allapi.com/v1/chat/completions请求参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 模型名,见 模型总览 |
messages | array | 是 | 对话消息数组,元素含 role 与 content |
stream | boolean | 否 | 是否流式返回,见 流式输出 |
temperature | number | 否 | 采样温度 0–2,越大越发散 |
top_p | number | 否 | 核采样阈值,与 temperature 二选一调整 |
max_tokens | number | 否 | 回复的最大 token 数 |
stop | string/array | 否 | 停止词 |
presence_penalty | number | 否 | 话题新颖度惩罚 -2–2 |
frequency_penalty | number | 否 | 重复度惩罚 -2–2 |
tools | array | 否 | 工具/函数调用定义(支持的模型) |
response_format | object | 否 | 如 {"type":"json_object"} 强制 JSON 输出 |
messages 中的 role 支持 system / user / assistant / tool。
content 可以是字符串,也可以是多模态数组(文本 + 图片,见 视觉理解)。
请求示例
curl https://api.4allapi.com/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer $AIPROXY_KEY" \ -d '{ "model": "fable-5", "messages": [ {"role": "system", "content": "你是一个严谨的技术助手"}, {"role": "user", "content": "用一句话解释什么是 API 网关"} ], "temperature": 0.7, "max_tokens": 512 }'响应结构
{ "id": "chatcmpl-xxx", "object": "chat.completion", "created": 1750000000, "model": "fable-5", "choices": [ { "index": 0, "message": { "role": "assistant", "content": "API 网关是……" }, "finish_reason": "stop" } ], "usage": { "prompt_tokens": 32, "completion_tokens": 41, "total_tokens": 73 }}usage 字段是计费依据,详见 计费与额度。