Chat Completions
Hoàn tất hội thoại là giao diện được dùng phổ biến nhất, hoàn toàn tương thích với giao thức OpenAI.
POST https://api.4allapi.com/v1/chat/completionsTham số yêu cầu
| Tham số | Loại | Bắt buộc | Mô tả |
|---|---|---|---|
model | string | Có | Tên mô hình, xem Tổng quan mô hình |
messages | array | Có | Mảng tin nhắn hội thoại, mỗi phần tử chứa role và content |
stream | boolean | Không | Có trả về theo luồng hay không, xem Đầu ra theo luồng |
temperature | number | Không | Nhiệt độ lấy mẫu 0–2, càng lớn càng phân tán |
top_p | number | Không | Ngưỡng lấy mẫu hạt nhân, điều chỉnh một trong hai với temperature |
max_tokens | number | Không | Số token tối đa của câu trả lời |
stop | string/array | Không | Từ dừng |
presence_penalty | number | Không | Phạt tính mới của chủ đề -2–2 |
frequency_penalty | number | Không | Phạt độ lặp lại -2–2 |
tools | array | Không | Định nghĩa gọi công cụ/hàm (các mô hình được hỗ trợ) |
response_format | object | Không | Ví dụ {"type":"json_object"} để buộc xuất JSON |
role trong messages hỗ trợ system / user / assistant / tool.
content có thể là chuỗi, hoặc cũng có thể là mảng đa phương thức (văn bản + hình ảnh, xem Hiểu hình ảnh)。
Ví dụ yêu cầu
curl https://api.4allapi.com/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer $AIPROXY_KEY" \ -d '{ "model": "fable-5", "messages": [ {"role": "system", "content": "你是一个严谨的技术助手"}, {"role": "user", "content": "用一句话解释什么是 API 网关"} ], "temperature": 0.7, "max_tokens": 512 }'Cấu trúc phản hồi
{ "id": "chatcmpl-xxx", "object": "chat.completion", "created": 1750000000, "model": "fable-5", "choices": [ { "index": 0, "message": { "role": "assistant", "content": "API 网关是……" }, "finish_reason": "stop" } ], "usage": { "prompt_tokens": 32, "completion_tokens": 41, "total_tokens": 73 }}Trường usage là căn cứ tính phí, xem chi tiết tại Thanh toán và hạn mức。