Бесплатные модели
4ALL API предоставляет набор полностью бесплатных открытых моделей, подходящих для проверки функциональности, учебных демонстраций и лёгких задач.
Бесплатные модели доступны в группе free; для вызова достаточно включить free в группу токенов.
Бесплатные модели в продаже (выборка)
| Модель | Описание |
|---|---|
qwen/qwen3.6-plus:free(-preview) | 通义千问, сильна в задачах на китайском языке |
z-ai/glm-4.5-air:free | 智谱 GLM, китайский диалог |
minimax/minimax-m2.5:free | MiniMax, ролевой диалог |
nvidia/nemotron-3-super-120b-a12b:free и др. | Серия NVIDIA Nemotron |
google/gemma-3-27b-it:free и др. | Открытая серия Google Gemma |
qwen/qwen3-next-80b-a3b-instruct:free | Предварительный просмотр новой архитектуры Qwen |
stepfun/step-3.5-flash:free | Быстрый тариф 阶跃星辰 |
nvidia/nemotron-nano-12b-v2-vl:free | Бесплатный тариф с визуальными возможностями |
Полный список смотрите в модельной витрине, отфильтровав по “бесплатным”.
Пример вызова
resp = client.chat.completions.create( model="qwen/qwen3.6-plus:free", messages=[{"role": "user", "content": "介绍一下你自己"}],)Примечания по использованию
- Бесплатно ≠ безлимитно: ограничения на параллельные запросы и частоту строже, чем у платных тарифов; см. Ограничение скорости и 429;
- Источник — каналы open source сообщества, стабильность и SLA не гарантируются; для основных продакшн-сценариев используйте платные модели;
- В названии модели обязательно должен быть суффикс
:free; модели с тем же именем в платном тарифе — это другой канал; - Подходит для сценариев: проверка прототипов, низкорисковая массовая грубая фильтрация, учебные демонстрации, базовая линия для сравнения моделей.