Сначала задача и KPI
Модель выбирают после метрики: время ответа, доля авто-маршрута, ошибка ввода. Иначе получится демо-чат, который не встроен в процесс.
Пилот на узком сценарии
Один-два потока, baseline vs after. Так видно, хватит ли готового API или нужен кастомный контур.
Качество: эталоны и эскалация
Eval-набор, порог уверенности, human-in-the-loop. Если модель не уверена — создаём тикет, а не выдумываем ответ.
В рабочей системе, не на отдельной вкладке
Ассистент живёт в тикетах, CRM или портале. Отдельное окно «поговорить с AI» почти никогда не меняет операции.
Риски
PII, drift, стоимость inference, утечки во внешние API. Это часть проектирования, не приложение к презентации.