Sortie des modèles de raisonnement
Certaines variantes de niveau de raisonnement des modèles 4ALL API permettent de choisir l’intensité du raisonnement via le suffixe du nom du modèle, sans paramètre supplémentaire :
Suffixes de niveau
| Suffixe | Signification | Exemple |
|---|---|---|
-low | Faible intensité de raisonnement, plus rapide et plus économique | gpt-5.5-low, gemini-3.1-pro-low |
| (sans suffixe) | Niveau par défaut | gpt-5.5 |
-high | Intensité de raisonnement élevée, plus stable pour les problèmes complexes | gpt-5.5-high, gemini-3.5-flash-high |
-xhigh | Niveau maximal (certains modèles) | gpt-5.5-xhigh |
-thinking | Mode de réflexion Claude | claude-opus-4-6-thinking |
Mode d’appel
Identique à une conversation normale, il suffit de changer le nom du modèle :
curl https://api.4allapi.com/v1/chat/completions \ -H "Authorization: Bearer $AIPROXY_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "gpt-5.5-high", "messages": [{"role": "user", "content": "证明根号2是无理数"}] }'Analyse de la sortie
- Le processus de raisonnement des modèles de type réflexion peut apparaître dans
reasoning_content(ou dans le même champ en incrémental en streaming), tandis que le texte principal reste danscontent; il est recommandé de replier le processus de raisonnement dans l’interface ; - Plus le niveau de raisonnement est élevé, plus le nombre de tokens de sortie est important, plus la latence est élevée et plus le coût est élevé — les tokens de raisonnement sont facturés comme des sorties ;
max_tokensdoit laisser une marge pour le processus de réflexion ; s’il est réglé trop bas, il est facile de n’obtenir que la réflexion avant troncature (finish_reason: length)。
Recommandations de choix
- Pour les questions quotidiennes, utilisez le niveau par défaut ; pour les maths, le débogage de code et la planification en plusieurs étapes, passez à
-high/-thinking; - Pour les pipelines en lot, commencez par un niveau bas pour l’ensemble, puis réévaluez les résultats à faible confiance avec un niveau élevé ; c’est le meilleur compromis en coût.