Aller au contenu
Site principal Actualités Console

Sortie des modèles de raisonnement

Certaines variantes de niveau de raisonnement des modèles 4ALL API permettent de choisir l’intensité du raisonnement via le suffixe du nom du modèle, sans paramètre supplémentaire :

Suffixes de niveau

SuffixeSignificationExemple
-lowFaible intensité de raisonnement, plus rapide et plus économiquegpt-5.5-low, gemini-3.1-pro-low
(sans suffixe)Niveau par défautgpt-5.5
-highIntensité de raisonnement élevée, plus stable pour les problèmes complexesgpt-5.5-high, gemini-3.5-flash-high
-xhighNiveau maximal (certains modèles)gpt-5.5-xhigh
-thinkingMode de réflexion Claudeclaude-opus-4-6-thinking

Mode d’appel

Identique à une conversation normale, il suffit de changer le nom du modèle :

Fenêtre de terminal
curl https://api.4allapi.com/v1/chat/completions \
-H "Authorization: Bearer $AIPROXY_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.5-high",
"messages": [{"role": "user", "content": "证明根号2是无理数"}]
}'

Analyse de la sortie

  • Le processus de raisonnement des modèles de type réflexion peut apparaître dans reasoning_content (ou dans le même champ en incrémental en streaming), tandis que le texte principal reste dans content ; il est recommandé de replier le processus de raisonnement dans l’interface ;
  • Plus le niveau de raisonnement est élevé, plus le nombre de tokens de sortie est important, plus la latence est élevée et plus le coût est élevé — les tokens de raisonnement sont facturés comme des sorties ;
  • max_tokens doit laisser une marge pour le processus de réflexion ; s’il est réglé trop bas, il est facile de n’obtenir que la réflexion avant troncature (finish_reason: length)。

Recommandations de choix

  • Pour les questions quotidiennes, utilisez le niveau par défaut ; pour les maths, le débogage de code et la planification en plusieurs étapes, passez à -high / -thinking ;
  • Pour les pipelines en lot, commencez par un niveau bas pour l’ensemble, puis réévaluez les résultats à faible confiance avec un niveau élevé ; c’est le meilleur compromis en coût.