Перейти к содержимому
Основной сайт Новости Консоль

Бесплатные модели

4ALL API предоставляет набор полностью бесплатных открытых моделей, подходящих для проверки функциональности, учебных демонстраций и лёгких задач. Бесплатные модели доступны в группе free; для вызова достаточно включить free в группу токенов.

Бесплатные модели в продаже (выборка)

МодельОписание
qwen/qwen3.6-plus:free(-preview)通义千问, сильна в задачах на китайском языке
z-ai/glm-4.5-air:free智谱 GLM, китайский диалог
minimax/minimax-m2.5:freeMiniMax, ролевой диалог
nvidia/nemotron-3-super-120b-a12b:free и др.Серия NVIDIA Nemotron
google/gemma-3-27b-it:free и др.Открытая серия Google Gemma
qwen/qwen3-next-80b-a3b-instruct:freeПредварительный просмотр новой архитектуры Qwen
stepfun/step-3.5-flash:freeБыстрый тариф 阶跃星辰
nvidia/nemotron-nano-12b-v2-vl:freeБесплатный тариф с визуальными возможностями

Полный список смотрите в модельной витрине, отфильтровав по “бесплатным”.

Пример вызова

resp = client.chat.completions.create(
model="qwen/qwen3.6-plus:free",
messages=[{"role": "user", "content": "介绍一下你自己"}],
)

Примечания по использованию

  • Бесплатно ≠ безлимитно: ограничения на параллельные запросы и частоту строже, чем у платных тарифов; см. Ограничение скорости и 429;
  • Источник — каналы open source сообщества, стабильность и SLA не гарантируются; для основных продакшн-сценариев используйте платные модели;
  • В названии модели обязательно должен быть суффикс :free; модели с тем же именем в платном тарифе — это другой канал;
  • Подходит для сценариев: проверка прототипов, низкорисковая массовая грубая фильтрация, учебные демонстрации, базовая линия для сравнения моделей.