Chat Completions
Дополнение диалога — самый часто используемый интерфейс, полностью совместимый с протоколом OpenAI.
POST https://api.4allapi.com/v1/chat/completionsПараметры запроса
| Параметр | Тип | Обяз. | Описание |
|---|---|---|---|
model | string | Да | Имя модели, см. Обзор моделей |
messages | array | Да | Массив сообщений диалога, элементы содержат role и content |
stream | boolean | Нет | Возвращать ли потоковый ответ, см. Потоковый вывод |
temperature | number | Нет | Температура сэмплирования 0–2, чем выше, тем более разнообразный вывод |
top_p | number | Нет | Порог ядровой выборки, настраивается вместо temperature |
max_tokens | number | Нет | Максимальное число токенов в ответе |
stop | string/array | Нет | Стоп-слова |
presence_penalty | number | Нет | Штраф за новизну темы -2–2 |
frequency_penalty | number | Нет | Штраф за повторяемость -2–2 |
tools | array | Нет | Определение вызова инструментов/функций (поддерживаемые модели) |
response_format | object | Нет | Например {"type":"json_object"} — принудительный вывод JSON |
role в messages поддерживает system / user / assistant / tool.
content может быть строкой или мультимодальным массивом (текст + изображение, см. Визуальное понимание).
Пример запроса
curl https://api.4allapi.com/v1/chat/completions \ -H "Content-Type: application/json" \ -H "Authorization: Bearer $AIPROXY_KEY" \ -d '{ "model": "fable-5", "messages": [ {"role": "system", "content": "Ты — строгий технический помощник"}, {"role": "user", "content": "Объясни в одном предложении, что такое API gateway"} ], "temperature": 0.7, "max_tokens": 512 }'Структура ответа
{ "id": "chatcmpl-xxx", "object": "chat.completion", "created": 1750000000, "model": "fable-5", "choices": [ { "index": 0, "message": { "role": "assistant", "content": "API gateway — это……" }, "finish_reason": "stop" } ], "usage": { "prompt_tokens": 32, "completion_tokens": 41, "total_tokens": 73 }}Поле usage используется как основа для биллинга; подробнее см. Биллинг и лимиты.