Aller au contenu
Site principal Actualités Console

Chat Completions

La complétion de dialogue est l’interface la plus couramment utilisée, et elle est entièrement compatible avec le protocole OpenAI.

POST https://api.4allapi.com/v1/chat/completions

Paramètres de requête

ParamètreTypeObligatoireDescription
modelstringOuiNom du modèle, voir Aperçu des modèles
messagesarrayOuiTableau de messages de dialogue, les éléments contiennent role et content
streambooleanNonIndique si la réponse est renvoyée en flux, voir Sortie en flux
temperaturenumberNonTempérature d’échantillonnage 0–2, plus elle est élevée, plus la sortie est diversifiée
top_pnumberNonSeuil d’échantillonnage par noyau, à ajuster au choix avec temperature
max_tokensnumberNonNombre maximal de tokens de la réponse
stopstring/arrayNonMot d’arrêt
presence_penaltynumberNonPénalité de nouveauté du sujet -2–2
frequency_penaltynumberNonPénalité de répétition -2–2
toolsarrayNonDéfinition des appels d’outils/fonctions (modèles pris en charge)
response_formatobjectNonPar exemple {"type":"json_object"} force une sortie JSON

Le role dans messages prend en charge system / user / assistant / tool. content peut être une chaîne, ou bien un tableau multimodal (texte + image, voir Compréhension visuelle).

Exemple de requête

Fenêtre de terminal
curl https://api.4allapi.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $AIPROXY_KEY" \
-d '{
"model": "fable-5",
"messages": [
{"role": "system", "content": "你是一个严谨的技术助手"},
{"role": "user", "content": "用一句话解释什么是 API 网关"}
],
"temperature": 0.7,
"max_tokens": 512
}'

Structure de la réponse

{
"id": "chatcmpl-xxx",
"object": "chat.completion",
"created": 1750000000,
"model": "fable-5",
"choices": [
{
"index": 0,
"message": { "role": "assistant", "content": "API 网关是……" },
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 32,
"completion_tokens": 41,
"total_tokens": 73
}
}

Le champ usage sert de base à la facturation, voir Facturation et quotas.