«Установить доверительный контакт» есть почти в каждом скрипте продаж, и этот пункт не проверит ни один алгоритм — а два опытных руководителя по нему тоже не договорятся. Деньги здесь теряются тихо: компания подключает автоматическую проверку звонков, получает баллы, которым никто не верит, и через месяц возвращается к выборочной прослушке. Скрипт, который AI сможет проверять, — это набор критериев, каждый из которых однозначно устанавливается по содержанию разговора. Ниже — как переписать в такие критерии «выявить потребность» и «отработать возражение», зачем нужны антипримеры, как калибровать результат на реальных звонках и когда вся эта работа не нужна.
Скрипт, который AI сможет проверять, описывает события, а не намерения
Проверяемый критерий — это утверждение о разговоре, истинность которого можно установить из содержания самого разговора, не додумывая. Практический тест простой: если два человека, прослушав один звонок, могут поставить разные оценки по пункту, критерий сформулирован плохо. Модель тут ни при чём. Она просто честно воспроизводит неясность, которую в скрипт заложили люди.
Сравните две формулировки одного требования:
- Непроверяемо: «Менеджер выявил потребность клиента».
- Проверяемо: «Менеджер задал минимум один открытый вопрос о текущей ситуации клиента до перехода к презентации».
Вторая формулировка фиксирует наблюдаемое событие: вопрос задан или нет, до презентации или после. Она же оказывается полезнее для обучения — менеджер понимает, что конкретно от него требуется.
Тот же принцип применим ко всем блокам. «Отработал возражение» превращается в «на возражение о цене менеджер привёл аргумент о ценности или предложил альтернативу, а не согласился с клиентом». «Договорился о следующем шаге» — в «в разговоре названа конкретная дата или день следующего контакта».
Побочный эффект приятный. Менеджер, который годами слышал «выявляй потребность лучше», впервые узнаёт, что именно от него хотят. Оказывается, половина претензий к отделу была претензией к формулировкам.
Хороший критерий выдерживает пять придирок
1. Однозначность
Критерий должен допускать только два исхода — выполнено или нет. Формулировки со словами «достаточно», «качественно», «уместно» вводят третье состояние, которое каждый определяет по-своему. Если хочется написать «достаточно подробно», нужно решить, что именно считается достаточным, и записать это.
2. Привязка к моменту разговора
Многие требования имеют смысл только в определённой точке диалога. «Назвал цену» — слабый критерий; «назвал цену до того, как клиент спросил о ней» — сильный, потому что проверяет инициативу менеджера. Порядок событий обычно и отличает сильный разговор от слабого.
3. Один критерий — одно требование
Пункт «поздоровался, представился и назвал компанию» на практике даёт неинформативную оценку: непонятно, что именно пропущено. Если все три элемента важны, их лучше развести или явно указать, что засчитывается только при выполнении всех.
4. Примеры и антипримеры
Пример показывает, что засчитывается. Антипример — что похоже, но не засчитывается. Именно антипримеры ловят самые дорогие ошибки. В опубликованном кейсе БФЛ-компании система принимала упоминание резидентства в Сколково за упоминание партнёрской программы: слова похожи, смысл разный. Такие пересечения невозможно предугадать заранее — они всплывают на первых прогонах и закрываются добавлением антипримеров.
5. Проверяемость на вашей лексике
Критерий должен опираться на то, как реально говорят ваши менеджеры и клиенты, а не на нормативную лексику из учебника. Если в вашем сегменте клиенты говорят не «дорого», а «нам сейчас не до этого», критерий про отработку ценового возражения должен это учитывать. Материал для таких формулировок берётся из записей — карта частых возражений показывает реальный язык.
Двенадцати пунктов хватает на звонок, если у каждого есть вес
Практичный чек-лист укладывается в 8–12 пунктов, сгруппированных по этапам разговора. Больше — и руководитель тонет в критериях, а менеджер перестаёт понимать, что из этого главное. Типовая структура для продающего звонка выглядит так:
- Начало. Представление и обозначение цели звонка.
- Диагностика. Открытый вопрос о ситуации клиента до презентации; уточнение сроков или объёма.
- Предложение. Презентация под выявленный запрос, а не по общему шаблону; названа цена.
- Возражения. Возражение отработано аргументом, а не согласием; предложена альтернатива при отказе.
- Закрытие. Назначен конкретный следующий шаг с датой; договорённость проговорена вслух.
- Обязательные элементы. Упоминание дополнительных продуктов или программ, если это требование бизнеса.
Каждый пункт получает вес: не все требования равнозначны, и провал по фиксации следующего шага обычно дороже, чем формальное отклонение в приветствии. Веса стоит задавать осознанно, иначе итоговый балл перестаёт отражать реальную цену ошибок. Менеджер, который бодро поздоровался и не назначил встречу, не должен получать больше того, кто буркнул «алло» и закрыл сделку.
Я бы задавала веса от денег, а не от традиции: какой пункт, если он провален, чаще всего предшествует потерянной сделке. Если ответа на этот вопрос нет, вес ставят поровну и пересматривают после первого месяца данных, а не придумывают из головы.
Калибровка на двадцати звонках решает, будут ли отчёту верить
Даже хорошо написанные критерии на первом прогоне понимаются не совсем так, как задумывал автор. Калибровка — обязательный шаг, а не опция.
Процедура простая. Берётся контрольная выборка из 10–20 разговоров, желательно разнородных: несколько сильных, несколько провальных, несколько пограничных. Руководитель проставляет оценки вручную, затем они сравниваются с автоматическими. Каждое расхождение разбирается: либо критерий сформулирован неоднозначно и его нужно уточнить, либо руководитель сам оценивал непоследовательно — и это тоже полезная находка.
Практический ориентир: калибровка редко проходит за один заход. Обычно требуется два-три цикла уточнения формулировок, и это нормальная часть внедрения. Быстрее всего процесс идёт в отделах с жёсткими скриптами и чёткой телефонией — колл-центр калибруется проще, чем свободные очные переговоры, поэтому пилот разумно начинать именно с него.
«Звучал убедительно» оставьте человеку
Честная граница экономит время. Надёжно измеряются наблюдаемые вещи: прозвучало ли слово, названо ли число, задан ли вопрос, назначена ли дата, каковы доли речи и темп, были ли перебивания.
Плохо формализуются интегральные оценки: «звучал убедительно», «выстроил доверие», «правильно почувствовал момент». Их зависимость от контекста и собеседника слишком велика. Практичный подход — не пытаться загнать их в чек-лист, а оставить человеку: система даёт наблюдаемые факты, руководитель на разборе делает качественный вывод, опираясь на них. Так снимается и главный риск — недоверие к оценке, которая кажется произвольной.
Отдельно стоит помнить, что модель может ошибаться, и доводить точность до уровня, при котором руководитель перестаёт перепроверять каждый балл, — это работа подбора формулировок, а не разовая настройка. Разница между «подключить систему» и «подключить так, чтобы ей доверяли принятие решений» измеряется неделями калибровки.
Как связать чек-лист со скриптом для AI-агента
Если AI-агент не только проверяет разговоры, но и ведёт их сам, требования к формулировкам ужесточаются: сценарий должен описывать не только что сказать, но и как реагировать на развилки. Это отдельный класс задач, разобранный в материале как написать скрипт продаж для AI-автозвонщика. Общая часть, впрочем, сохраняется: наблюдаемые формулировки и явно прописанные ветки одинаково полезны и для проверки, и для исполнения.
Когда автоматическая проверка скрипта не нужна
Звучит странно от человека из компании, которая такие проверки настраивает, но не каждому отделу это нужно.
Звонков мало. Если отдел делает несколько разговоров в день, руководитель слышит почти все сам, а на калибровку уйдёт больше времени, чем на прослушку. Автоматическая проверка здесь не окупится.
Скрипта по сути нет. Сложные переговоры с несколькими встречами, где каждый разговор уникален, плохо ложатся в чек-лист из наблюдаемых пунктов. Можно проверить пару обязательных вещей — назван ли следующий шаг, прозвучала ли цена, — но ждать от балла глубокой оценки переговорщика не стоит.
По результату ничего не изменится. Если отчёт о выполнении пунктов не повлияет ни на обучение, ни на скрипт, ни на разбор проигранных сделок, это отчёт ради отчёта. Дешевле не начинать.
Стандарт состоит из «убедительно» и «с душой». Такой скрипт сначала переписывают люди, а уже потом проверяет машина. В 404ai, если стандарт почти целиком из таких пунктов, мы говорим об этом до договора, а не после первого отчёта.
Начинайте с пунктов, от которых зависят деньги
Главный вывод для решения: переписывать весь скрипт в критерии не нужно. Сначала решите, для чего нужна проверка — обучение новичков, поиск причины провала этапа, контроль обязательных условий, — и переведите в наблюдаемые формулировки только пункты, связанные с этой целью. Пункты, которые не влияют ни на что измеримое, честнее убрать, чем оцифровывать.
Проверить свой скрипт можно сегодня и без подрядчика. Возьмите пять ключевых пунктов, дайте двум руководителям независимо оценить по ним одни и те же десять звонков и сравните. Где они разошлись — там формулировка непроверяема, и машина разойдётся тоже. Если после переписывания сходимость хорошая, можно переходить к пилоту на своих разговорах: подобрать антипримеры, сверить автоматические оценки с ручными и договориться, что будет признаком остановки. Так по методу «Цель → метрика» работает 404ai; сама проверка всех звонков делается в Эхолитикс, разбор стоит 1,5 ₽ за минуту разговора, данные остаются в РФ по 152-ФЗ. Со стороны отдела нужен человек, который согласует стандарт и выделит время на сверку, — без него калибровка не закончится. Принесите скрипт на разбор задачи, если хотите сделать это на своих звонках вместе.
Скрипт, который нельзя проверить, обычно нельзя и выполнить. Машина просто первой говорит об этом вслух.