Modèles gratuits
4ALL API fournit une série de modèles open source entièrement gratuits, adaptés à la validation fonctionnelle, aux démonstrations pédagogiques et aux tâches légères.
Les modèles gratuits se trouvent dans le groupe free; il suffit d’inclure free dans le groupe de jetons pour pouvoir les appeler.
Modèles gratuits disponibles à la vente (extrait)
| Modèle | Description |
|---|---|
qwen/qwen3.6-plus:free(-preview) | Tongyi Qianwen, fort pour les tâches en chinois |
z-ai/glm-4.5-air:free | GLM de Zhipu, dialogue en chinois |
minimax/minimax-m2.5:free | MiniMax, dialogue de rôles |
nvidia/nemotron-3-super-120b-a12b:free etc. | Série Nemotron de NVIDIA |
google/gemma-3-27b-it:free etc. | Série open source Gemma de Google |
qwen/qwen3-next-80b-a3-b-instruct:free | Aperçu de la nouvelle architecture Qwen |
stepfun/step-3.5-flash:free | Offre rapide StepFun |
nvidia/nemotron-nano-12b-v2-vl:free | Offre gratuite avec capacités visuelles |
La liste complète est disponible dans laPlace de modèles en filtrant sur « gratuit ».
Exemple d’appel
resp = client.chat.completions.create( model="qwen/qwen3.6-plus:free", messages=[{"role": "user", "content": "介绍一下你自己"}],)À noter
- Gratuit ≠ illimité : les limites de concurrence et de fréquence sont plus strictes que pour les offres payantes, voirLimitation de débit et 429;
- L’amont provient des canaux de la communauté open source, aucune garantie de stabilité ni de SLA n’est fournie ; pour les chemins critiques de production, veuillez utiliser des modèles payants ;
- Le nom du modèle doit obligatoirement se terminer par
:free; un modèle portant le même nom que la version payante emprunte un canal différent ; - Scénarios adaptés : validation de prototypes, tri grossier par lots à faible risque, démonstrations pédagogiques, références de base pour la comparaison de modèles。