Перейти к содержимому
Основной сайт Новости Консоль

Умная поддержка клиентов

Автоматически распределяйте модели по сложности вопроса, достигая баланса между опытом, затратами и стабильностью. Переключение моделей в 4ALL API сводится к изменению поля model, а многоуровневую маршрутизацию можно реализовать на стороне бизнеса всего несколькими строками кода.

Стратегия многоуровневой маршрутизации

УровеньСценарийРекомендуемая модель
L1 Быстрый ответПриветствия, FAQ, запросы по заказуgpt-5.4-minigemini-3.5-flash
L2 СтандартныйМногоходовые консультации, обработка послепродажных обращенийgpt-5.5claude-haiku-4-5
L3 СложныйЖалобы, сложные объяснения политикиclaude-sonnet-5gpt-5.5-high
def pick_model(question, history):
if is_faq(question):
return "gpt-5.4-mini"
if needs_escalation(question, history):
return "claude-sonnet-5"
return "gpt-5.5"

Ключевые моменты внедрения

  • Все модели работают через один и тот же интерфейс Chat Completions, переключение без доработок; см. Chat Completions;
  • Используйте потоковый вывод, чтобы снизить задержку до первого токена; разница в опыте поддержки заметна;
  • Создайте отдельный токен для системы поддержки и задайте верхний предел квоты, чтобы упростить расчет затрат и ограничение убытков; см. Аутентификация и ключи;
  • При случайных сбоях на стороне upstream используйте коды ошибок и повторные попытки для деградации (например, при L3 откатывайтесь на модель L2).