ИИ в ответах
Еженедельная проверка качества ИИ-ответов

Качество ИИ-ответов проверяется не отчётом платформы, а чтением диалогов — пятнадцать минут в неделю и два конкретных срез: диалоги, которые оборвались, и диалоги, которые пришлось подхватить человеку. Именно там видно, где ассистент не дотягивает.
Главная ловушка — смотреть на количество ответов. Ассистент может ответить на сотню сообщений и не привести ни одного заказа; это выглядит как работа и ею не является.

Какие диалоги читать, а какие пропустить?
Читать нужно только два типа. Остальные — пропустить, они ничего не скажут.
- 1
Оборванные диалоги
Ассистент ответил — клиент замолчал. Самая частая причина: ответ не дал следующего шага.
- 2
Переданные менеджеру
Здесь видна граница автоматизации: либо ассистент правильно отдал сложное, либо не смог простое.
- 3
Повторные вопросы
Клиент переспрашивает одно и то же дважды — ответ был формально правильным и непонятным.
- 4
Успешные — выборочно
Два-три для контроля тона. Не больше: они подтверждают, а не учат.
Что именно измерять?
Три числа, которые можно посчитать вручную по выборке:
- Сколько диалогов дошли до следующего шага — то есть клиент назвал размер, город или согласился на оформление. Это и есть польза.
- Сколько ушли к человеку — и главное, по какой причине. Правильная передача (жалоба, торг) — это успех, а не сбой. Передача из-за «не понял вопроса» — сбой.
- Сколько оборвались после ответа ассистента. Если эта доля не падает между неделями, проблема в структуре ответов, а не в отдельных формулировках.
Когда править инструкцию, а когда добавлять сценарий?
Правило, которое экономит месяцы: сценарий лечит один случай, инструкция лечит класс случаев. Если ошибка может повториться в другой теме — это инструкция.
Пример. Ассистент выдумал срок доставки в город. Слабое решение — добавить сценарий «этот город → 2 дня». Сильное — правило «сроки называй только из таблицы доставки; города не в таблице → уточню и напишу». Второе закрывает все города сразу, включая те, о которых ещё не спрашивали.
Как не сломать то, что работает?
Одно изменение за итерацию. Это скучно и это единственный способ понять, что подействовало.
Перед правкой сохраните несколько реальных вопросов как тест: наличие, цена, доставка, торг, жалоба. После правки прогоните их все. Если улучшился ответ о цене и сломалась передача жалобы — вы это увидите сразу, а не через неделю от клиента.
Чеклист еженедельной проверки
- Открыть диалоги за неделю, отобрать оборванные и переданные человеку.
- Прочитать 10–15, заметить повторяющиеся причины (не отдельные ошибки — именно паттерны).
- Посчитать три числа: дошли до шага / ушли к человеку / оборвались.
- Выбрать ОДНО изменение инструкции, закрывающее самый частый паттерн.
- Прогнать набор тестовых вопросов до и после изменения.
- Записать строку в таблицу недели.
Частые вопросы
Сколько диалогов нужно читать каждую неделю?
Десять-пятнадцать достаточно, если выбирать их правильно: не случайные, а те, что оборвались без ответа клиента, и те, где диалог ушёл к менеджеру. Именно там видны границы ассистента.
Какой главный показатель качества ИИ-ответов?
Доля диалогов, которые ассистент довёл до конкретного следующего шага, — без вмешательства человека и без того, чтобы клиент переспрашивал одно и то же. Количество ответов ничего не говорит: бот может ответить сто раз и не продать ничего.
Что делать, когда ассистент ошибся?
Сначала понять, чего именно ему не хватило: данных, разрешения сказать «не знаю» или чёткого запрета. Править инструкцию, а не добавлять сценарий — новый сценарий лечит один случай, правило лечит класс случаев.
Как часто стоит менять инструкцию ассистента?
Не чаще раза в неделю и по одному изменению за раз. Несколько правок одновременно делают невозможным вывод о том, какая из них помогла, а какая испортила.
Когда понять, что ИИ здесь вообще не подходит?
Когда после нескольких итераций та же категория вопросов по-прежнему уходит к человеку. Это не поражение: значит, эти диалоги по своей природе требуют решения, а не ответа. Уберите их из автоматизации осознанно.



