Первый массовый отчёт нужен не для рейтинга сотрудников. Его задача - сузить 26 критериев до одного участка разговора, который стоит проверить на реальных звонках и затем откалибровать.

В первой статье серии я показал, как исходный чек-лист таксопарка превратился в 26 рабочих критериев 0/1. Следующий этап - применить их к реальным разговорам.

На момент первого видео-комментария клиенту было разобрано около 50 звонков одного сотрудника. Такой объём ещё не даёт оснований судить обо всём отделе. Но его достаточно, чтобы проверить сам маршрут анализа и понять, где появляется сигнал для дальнейшей работы. Первый отчёт я рассматриваю именно как разведку. Его задача не в том, чтобы быстро назвать плохого менеджера. Его задача - сузить поле внимания.

Сначала кластер, потом критерий, потом звонок

Смотреть сразу на 26 отдельных показателей неудобно. Поэтому критерии были объединены в смысловые группы: приветствие и потребность, квалификация, презентация, работа с возражениями, следующий шаг, завершение разговора и ведение разговора.

В сводном отчёте сначала виден результат по группе. Затем кластер можно раскрыть и посмотреть, какой критерий тянет показатель вниз. После этого уже имеет смысл открывать конкретный разговор. Рабочая последовательность выглядит так:

группа критериев -> конкретный критерий -> объяснение оценки -> звонок -> конкретная реплика.

Именно этот переход от общей цифры к доказательству для меня важнее самого среднего балла. Среднее показывает, где есть отклонение. Причина становится понятна только после проверки разговора.

Самый низкий показатель не обязательно главный

В первой выборке самым низким оказался критерий:

“Клиент озвучил важные для него аспекты при выборе таксопарка”.

Можно было сразу выбрать его как главную проблему. Но на этапе разведки я разделяю два вопроса:

Где результат ниже?

и

Что сейчас важнее для бизнеса?

Это не всегда одно и то же. Например, руководитель может решить, что сейчас важнее завершение разговора и следующий шаг клиента. Менеджер может нормально отвечать на вопросы, объяснять условия и проводить квалификацию. Но если содержательный разговор заканчивается без понятной договорённости о продолжении, именно этот участок может оказаться текущим управленческим фокусом.

Поэтому первый отчёт нужен не для автоматического выбора самого красного показателя. Он нужен, чтобы увидеть варианты и выбрать, куда углубляться с учётом бизнес-процесса.

Ноль - это место для проверки

Один из критериев в первой выборке был сформулирован так:

“Менеджер подвёл итог достигнутых договорённостей”.

По нему в отчёте стоял 0. Быстрый вывод звучал бы просто:

“Менеджер не умеет завершать разговор”.

Но из одной цифры этого не следует. Следующий шаг - открыть объяснение оценки. В конкретном разборе система указывала, что не нашла явного действия менеджера, которое суммирует или подтверждает ранее согласованные условия, шаги или решения. После этого нужно открыть сам звонок и посмотреть его конец.

В разговоре могло прозвучать что-то вроде:

“Хорошо, приезжайте”.

Это может быть следующим шагом. Но является ли это подведением итогов? Не обязательно. Отдельное действие выглядело бы иначе:

“Давайте подведу итог. Мы проговорили условия, договорились, что вы приедете тогда-то. Всё верно?”

В таком варианте менеджер действительно суммирует достигнутую договорённость и проверяет её с клиентом. Именно здесь цифра превращается в предмет для обсуждения.

Иногда системный 0 показывает отсутствие стандарта

Допустим, похожий критерий получает 0 почти во всех подходящих разговорах.
Первое объяснение - сотрудники не выполняют требование.

Но до этого вывода я проверяю, существует ли само требование в достаточно конкретном виде.
Что именно означает “подвести итог”?
Нужно назвать следующий шаг?
Повторить дату?
Зафиксировать место?
Проговорить основные условия?
Получить подтверждение клиента?

Если у компании нет однозначного ответа, аналитика обнаруживает не только поведение сотрудников. Она показывает, что сам управленческий стандарт ещё нужно договорить. В видео-комментарии клиенту я выделил три возможных объяснения системного нуля:

  1. сотрудники не знают, как выполнить действие;
  2. сотрудники считают такое действие неуместным для этого типа разговора;
  3. сотрудники знают стандарт, но не выполняют его регулярно.

При разборе данных появляется ещё одна аналитическая гипотеза:
4. сам критерий описан недостаточно точно.
Эти версии нельзя различить по одной цифре. Для этого нужны звонки.

Первый отчёт не должен становиться рейтингом сотрудников

На этом этапе критерии ещё проходят проверку на реальных разговорах. Если сразу посчитать общий процент качества и начать сравнивать сотрудников, получится ложная точность.
Например, один сотрудник получил 62%, другой 71%, третий 78%. Цифры выглядят убедительно.

Но внутри такого среднего могут находиться:

  • критерии с неясной формулировкой;
  • критерии, которым не хватает бизнес-контекста;
  • условные критерии, которые применимы не ко всем разговорам;
  • требования, которые сама команда понимает по-разному.

Поэтому на этапе разведки меня интересует не итоговый рейтинг, а места, где нужно проверить логику оценки.
Первый отчёт должен отвечать на вопрос:

“Куда посмотреть глубже?”

Для регулярной оценки сотрудников нужен уже более устойчивый стандарт.

Неприменимый критерий создаёт ложный ноль

В выборке были короткие звонки, в том числе разговоры примерно по 35 секунд. От такого контакта нельзя разумно ожидать прохождения всех 26 критериев. За короткий технический разговор менеджер может вообще не дойти до полноценной квалификации, презентации, работы с возражением, согласования следующего шага и подведения итогов.

Если по всем отсутствующим действиям автоматически поставить 0, отчёт покажет просадку, которой в реальности может не быть. Поэтому у критерия нужна не только формулировка, но и правило применимости.

До 0 и 1 есть ещё один вопрос

Для условных критериев логика должна начинаться не с оценки. Сначала:

Этот критерий вообще относится к данному разговору?

И только если относится:

Выполнен он или нет?

Например, критерий:

“При наличии возражения менеджер уточнил его суть”.

Если клиент не возражал, поставить 1 нельзя. Менеджер не выполнял это действие. Но и 0 будет неправильным сигналом. Нарушения тоже не было. Значит, такой разговор не должен участвовать в расчёте этого критерия.

В бинарной модели 0/1 применимость нужно определить раньше самой оценки.

Длительность может быть фильтром, но не универсальным правилом

В обсуждении первого отчёта звучал простой технический вариант: часть критериев или целый кластер оценивать только после определённой длительности разговора. Для блока завершения в качестве примера обсуждался порог около трёх минут. Я не считаю три минуты универсальным стандартом. Это только возможный фильтр, который нужно проверить на статистике конкретного процесса.

Разговор может длиться пять минут и оставаться техническим. И наоборот, содержательная договорённость иногда появляется быстрее. Поэтому длительность полезна как первый технический признак, но не заменяет бизнес-условие применимости.

Общий отчёт должен уменьшать поле внимания

После первого массового прохода не нужно одновременно исправлять всё, что выглядит слабым. Если отчёт показывает 8 низких критериев, сотрудник не сможет завтра одинаково хорошо изменить 8 элементов разговора. Разведка полезна, когда она позволяет выбрать один участок. Например, руководитель решает исследовать блок следующего шага.

Тогда можно отдельно открыть только связанные критерии:

  • предложил ли менеджер конкретное действие;
  • получил ли согласие или отказ;
  • согласовал ли следующий шаг;
  • зафиксировал ли применимые детали;
  • подвёл ли итог договорённостей.

Дальше уже можно спокойно смотреть звонки и сравнивать оценки. Общий отчёт отвечает:

“Куда смотреть?”

Отдельный кластер:

“Что именно там происходит?”

Конкретный звонок:

“Почему получилась такая оценка?”

Это 3 разных уровня анализа.

Рабочий алгоритм первого анализа звонков

Для текущего проекта последовательность получилась такой:

  1. Прогнать первую версию критериев по массиву звонков.
  2. Посмотреть результаты по смысловым группам.
  3. Найти заметные отклонения.
  4. Не путать самый низкий показатель с самым важным для бизнеса.
  5. Выбрать один кластер.
  6. Найти внутри него конкретный критерий.
  7. Открыть звонки с разными оценками.
  8. Проверить объяснение системы по тексту разговора.
  9. Проверить, достаточно ли точно сформулирован сам критерий.
  10. Проверить применимость критерия к таким звонкам.
  11. Выбрать один участок для детальной калибровки.

После этого разведка заканчивается. Начинается другая работа.

Разведка и калибровка отвечают на разные вопросы

Разведка отвечает:

Где находится сигнал?

Калибровка отвечает:

Что именно в этой зоне должно считаться правильным поведением?

Например, разведка показала, что подведение итогов требует внимания. Этого ещё недостаточно, чтобы использовать показатель как регулярный управленческий стандарт.
Нужно определить:

  • что именно сотрудник должен сделать;
  • в каких разговорах это требуется;
  • что является хорошим примером;
  • что выглядит похоже, но не засчитывается;
  • что означает 1;
  • что означает 0;
  • какие разговоры вообще участвуют в оценке.

Общий принцип такой калибровки я отдельно разбирал в статье про критерии оценки звонков и единый стандарт.
В этой серии я прохожу тот же путь на одном конкретном проекте.

Что дал первый отчёт

До анализа было 26 критериев. После первого массового прохода появились более полезные вопросы:

  • какой кластер важнее для текущего бизнес-процесса;
  • что стоит за его низким показателем;
  • подтверждается ли оценка конкретными разговорами;
  • понимают ли сотрудники ожидаемое действие;
  • достаточно ли точно описан критерий;
  • к каким разговорам его вообще нужно применять.

Такой результат для меня полезнее общего процента качества.

Первый отчёт не даёт готовый диагноз. Он уменьшает неопределённость и показывает участок, который стоит исследовать следующим. Если после 26 критериев внимание удалось сузить до одного конкретного действия, разведка свою задачу выполнила.

Следующий этап - сделать выбранный критерий достаточно точным, чтобы его можно было использовать как рабочий стандарт.

Если нужен более широкий контекст по самому процессу, отдельно есть материал про сервис анализа звонков и переход от разговоров к управленческим действиям.

FAQ

Что означает 0 по критерию речевой аналитики?

0 означает, что в разговоре, к которому применим критерий, система не обнаружила его выполнение. Сам по себе 0 не объясняет причину и требует проверки конкретного разговора и формулировки критерия.

Если по критерию везде 0, значит менеджеры работают плохо?

Не обязательно. Сотрудники могут не знать стандарт, считать действие неуместным, знать его, но выполнять нерегулярно. Кроме того, сам критерий может быть недостаточно точно описан.

Как выбрать критерий для улучшения после первого анализа звонков?

Нужно смотреть не только на самый низкий показатель, но и на бизнес-значимость. Первый отчёт помогает выбрать один кластер или критерий, который заметно отклоняется и важен для следующего шага клиента.

Нужно ли оценивать все звонки по одинаковым критериям?

Нет. Часть критериев применима только к определённым типам разговоров или этапам коммуникации. Сначала нужно определить применимость и только потом ставить 0 или 1.

Что делать с неприменимым критерием при шкале 0/1?

Не ставить автоматически ни 0, ни 1. Сначала разговор исключается из оценки по этому критерию, а бинарная оценка применяется только к подходящим разговорам.

Можно ли использовать длительность звонка как условие применимости?

Можно как технический фильтр, но конкретный порог нельзя считать универсальным. Его нужно определять по реальным разговорам и бизнес-процессу конкретной компании.

Чем разведочный анализ отличается от оценки сотрудников?

Разведочный анализ ищет, где находится сигнал и какой участок стоит разбирать глубже. Оценка сотрудников требует уже согласованного, понятного и откалиброванного стандарта.

Серия

Речевая аналитика для таксопарков

  1. 10 Чек-лист оценки звонка для таксопарка: как перевести критерии клиента в 0/1
  2. 20 Анализ звонков таксопарка: почему 0 ещё не означает проблему менеджера
  3. 30 Калибровка звонков в таксопарке: как определить границы критерия 0/1