Робот, который на раздражённое «мне неудобно» бодро продолжает зачитывать предложение, теряет не один разговор, а контакт из базы: человек запоминает номер, ставит его в спам или просит больше не звонить. Интонация клиента в автообзвоне — это то, как сказана реплика: темп, громкость, перелом тона, — и она часто важнее самих слов. Фонекс распознаёт настроение собеседника по ходу звонка и меняет формулировку и тактику следующей реплики. Вопрос для заказчика обзвона не в том, «умеет ли робот сочувствовать», а в том, сколько контактов базы сохранится для следующей кампании.
Одно «мне это не нужно» бывает отказом и бывает неудачным моментом
Формально диалог можно вести, реагируя только на то, что клиент сказал буквально. Но фраза «мне это не нужно» звучит по-разному: как окончательный отказ или как реакция на звонок во время совещания, которую снимает одно уточнение.
Что это значит в деньгах: система, которая слышит только слова, ошибается в обе стороны. Настаивает там, где нужно отступить, — и получает жалобу и отписку. Сдаётся там, где достаточно было спросить удобное время, — и теряет контакт, за который база уже оплачена.
Вердикт: в исходящем обзвоне стоимость ошибки считается не в одном звонке, а в выжженной базе.
Интонацию слушают по ходу звонка, а не в расшифровке после
Анализ идёт по голосу собеседника прямо в разговоре, а не по тексту постфактум: темп речи, громкость, изменение тона в середине фразы. Эти признаки складываются в оценку состояния — раздражение, спешка, заинтересованность, нейтральность, — и она меняет то, как Фонекс формулирует следующую реплику.
Нейтральный тон на «мне неудобно сейчас» — Фонекс уточняет удобное время и вежливо завершает звонок. Раздражённый тон на ту же фразу — Фонекс сначала явно признаёт неудобство момента, извиняется за звонок не вовремя и только потом, если клиент не завершает разговор сам, коротко уточняет время для повторного звонка.
Вердикт: разница между двумя реакциями — одна фраза извинения, и именно она решает, возьмут ли трубку в следующий раз.
Логика сценария держится, меняется подача реплики
Здесь важно не перепутать две вещи. Сценарий Фонекса — это дерево диалога с ветками под возражения и варианты ответов, и по логике он не отклоняется: шаги не пропускаются, обещаний сверх сценария нет. Меняется не маршрут разговора, а то, как произносится и формулируется реплика на этом маршруте: уточнить, успокоить, предложить альтернативу.
У простого бота с кнопками всё иначе: каждая реакция ведёт в заранее записанную фразу, а ответ, которого нет среди вариантов, приводит к зависанию или реплике невпопад. Два разговора с одинаковым началом у такого бота звучат одинаково, у Фонекса — могут разойтись уже на второй реплике, если похожие слова произнесены с разной интонацией.
Что это значит для заказчика: жёсткая логика защищает от импровизации, которой вы не согласовывали, гибкая подача — от механического звучания. Нужно и то и другое.
Вердикт: робот, который импровизирует по содержанию, опасен; робот, который не умеет менять тон, раздражает.
При устойчивом раздражении звонок лучше закончить
Реакция на тон не означает попытку продавить любой ценой. Если раздражение остаётся высоким после уточнения и извинения, разговор не тянется дальше по сценарию: естественнее и честнее завершить звонок или передать его живому оператору, чем продолжать против явного сигнала клиента.
Для заказчика это решение про деньги, а не про вежливость. Дожатый раздражённый собеседник редко становится покупателем, а вот жалобу оператору связи или отказ от любых будущих звонков оставляет охотно.
Вердикт: правило «вовремя положить трубку» стоит прописать в сценарии до запуска, а не после первой жалобы.
Простуженный клиент звучит как разгневанный
Голосовые признаки — сигнал вероятностный. Часть ошибок предсказуема, и знать их полезнее, чем верить в точность.
Громкая быстрая речь не обязательно означает раздражение: так говорят на улице, в цеху и просто эмоциональные люди. Простуда, усталость и плохая связь меняют голос так же, как эмоция. Акцент и региональные особенности речи смещают оценку, если система настраивалась на другом материале.
Отсюда практическое правило: распознанный тон не должен принимать решений в одиночку. Он работает наравне с содержанием ответа и историей контакта. Сценарий, который разворачивается только по тону, будет регулярно извиняться перед спокойным человеком, который просто стоит у дороги.
Вердикт: тон — один из голосов в решении, а не решающий.
Сжатая телефония и короткие ответы срезают признаки тона
Качество распознавания зависит не только от системы, но и от того, в каком виде до неё доходит звук. Первое условие — канал. Сильное сжатие, характерное для некоторых видов телефонии, срезает часть частот, а с ними часть признаков, по которым различается тон.
Второе — длительность. По двум секундам речи оценить изменение тона нельзя: нужен участок, на котором есть с чем сравнивать. В разговорах, где клиент говорит одну фразу и кладёт трубку, тон анализировать бессмысленно, и сценарий не должен на него опираться.
Третье — разделение говорящих. Если запись сведена в один канал и голоса накладываются, оценка относится к смеси, а не к клиенту. Раздельная запись каналов решает это и обычно настраивается на стороне телефонии.
Вердикт: прежде чем обсуждать качество распознавания, стоит проверить качество звука, который до него доходит.
Карта раздражения по шагам сценария полезнее реакции в моменте
Реакция на тон в разговоре — очевидное применение, но, по-моему, не главное. Разметка тона по всему потоку звонков кампании даёт картину, которую иначе получить негде.
Видно, на каком шаге сценария тон собеседников чаще всего меняется к худшему. Если раздражение стабильно появляется после одного и того же вопроса, проблема не в клиентах и не в распознавании, а в вопросе — его надо переформулировать или переставить.
Так же находятся обратные места: фрагменты, после которых разговор явно теплеет. Их стоит переносить выше по сценарию. Это более надёжный источник правок, чем общие представления о том, как надо разговаривать с клиентами, — и дешёвый: данные уже собраны самой кампанией.
Вердикт: робот, который смягчает тон в одном звонке, спасает звонок; сценарий, исправленный по карте раздражения, спасает кампанию.
Пользу реакции на тон проверяют по двум числам, а не по одному
Утверждение «система меняет тактику при раздражении» проверяемо, и проверять его стоит, иначе это описание механики без доказательства пользы.
Схема простая: возьмите разговоры, где было распознано раздражение, и сравните исходы при разных тактиках. Часть таких разговоров ведётся со смягчением и уточнением, часть — по обычному сценарию. Сравниваются доля доведённых до цели и доля резких завершений.
Второй показатель важен не меньше первого. Тактика, которая повышает долю доведённых разговоров, но одновременно увеличивает число людей, кладущих трубку молча, скорее всего просто удлиняет диалог с теми, кто и так соглашался. Полезной её делает улучшение обоих чисел.
И проверка, про которую забывают: сравните долю разговоров с распознанным раздражением у разных сценариев за один период. Если после правки сценария таких разговоров стало заметно меньше, дело может быть не в удачной тактике, а в том, что люди стали быстрее класть трубку, и система просто не успевает ничего распознать.
Вердикт: падение числа «раздражённых» звонков — хорошая новость, только если одновременно не выросло число коротких.
Когда распознавание тона ничего не добавит к обзвону
Честно о границах. Есть кампании, где тон собеседника почти не влияет на результат. Короткое информирование — напоминание о записи, статусе заказа, сроке платежа — заканчивается за несколько реплик, и признаки тона там не успевают проявиться. Здесь важнее чистая база, правильное время звонка и понятный текст.
Второй случай — маленькая база. Если обзванивать нужно несколько сотен контактов один раз, автоматизация целиком может не окупить подготовку сценария, интеграции и калибровки: стандартный запуск Фонекса занимает около трёх недель. Двое сотрудников на пару дней справятся дешевле и с живой интонацией по умолчанию.
Третий — база без согласия на звонки. Никакая эмпатия не исправит того, что человеку звонят без законного основания: Фонекс работает только по базам с согласием на обработку персональных данных, и если такой базы нет, начинать нужно не с робота.
Мы в 404ai разбираем эти условия до договора: объём базы, тип кампании, законность контакта. Если автообзвон не даст эффекта, говорим об этом сразу — так устроен наш метод «Цель → метрика».
Интонация сохраняет базу для следующей кампании
Что это меняет в решении: при выборе автообзвона вопрос «насколько живой голос у робота» стоит дополнить вопросом «что робот делает, когда собеседник раздражён, и где это прописано». Ответ «продолжает по сценарию» означает, что за каждую кампанию вы платите не только ценой контакта — 6 ₽ за состоявшийся контакт у Фонекса, — но и частью базы, которая больше не возьмёт трубку.
Проверить на своих данных можно на первой же кампании или пилоте. Посчитайте три числа: долю звонков с распознанным раздражением, долю отказов от дальнейших звонков и долю доведённых до цели разговоров — отдельно по шагам сценария. Шаг, после которого раздражение и отказы растут одновременно, — первое место для правки. Если после правки обе доли снизились, а доля доведённых разговоров не упала, реакция на тон работает на вашей базе.
Как проверить сам голос, который это озвучивает, на своих клиентах — в статье голос AI-автозвонщика: слепой тест на своей базе. Заказать демо-звонок на свой номер можно на странице Фонекса.