
РАЗБОР
Записи звонков в колл-центре: тысячи файлов, которые никто не слушает
Двадцать операторов дают 1170 часов разговоров в месяц, а слушают меньше процента. Что достаётся из архива, когда он становится текстом: причины обращений, слова клиентов, поиск.
Зачем колл-центру записи звонков: четыре разные причины
Записи звонков в колл-центре начинаются одинаково: кнопку включают один раз и навсегда, а потом годами не возвращаются к вопросу, что с этими файлами делать. Причин, по которым разговоры пишут, обычно четыре, и расходятся они в главном — сколько записей нужно каждой.
- Обучение. Новичку дают послушать десяток разговоров: пять образцовых и пять провальных. Нужны единицы записей, почти всегда одни и те же.
- Споры. «Мне обещали бесплатную замену» — запись это либо подтверждает, либо нет. Нужен один разговор, но найти его требуется за минуты, а не за день.
- Контроль качества. Супервизор слушает выборку и ставит отметки по чек-листу. Нужны десятки записей в месяц, отобранных не наугад.
- Продукт и маркетинг. С чем люди приходят чаще всего, какими словами описывают проблему, из-за чего уходят. Здесь нужен весь массив: доля причины считается по всем разговорам.
Первые три задачи закрываются прослушиванием — потому и живут. Четвёртая не закрывается им никогда: чтобы узнать, сколько раз за месяц спросили про сроки доставки, разговоров нужно не пять, а все семнадцать тысяч. Она и остаётся невыполненной.
Почему выборочное прослушивание не выдерживает объёма
Возьмём колл-центр среднего размера: двадцать операторов, у каждого около сорока разговоров в день, средняя длительность четыре минуты. За двадцать два рабочих дня набегает 17 600 разговоров и примерно 1170 часов записи. Прослушать это одному человеку — 147 рабочих дней, то есть команда из семи слушателей, которые не делают больше ничего.
Реальность выглядит иначе: два-пять звонков на оператора в месяц, то есть от сорока до ста разговоров, — от 0,2 до 0,6 % архива. Поднять планку до одного процента легко на бумаге; на практике это почти три часа в наушниках каждую неделю, только прослушивание, без пометок и без разбора с людьми.
Дальше — то, что редко проговаривают вслух. Выборка отвечает на вопрос «как разговаривает этот оператор», и отвечает неплохо. На вопрос «сколько раз за месяц у нас спрашивали про возврат» она не отвечает ни при каком размере: доля причины по определению считается на всём массиве. Улучшать отбор здесь бесполезно — задача решается не ухом.
Отбор записей на разбор с оператором — задача соседняя, со своими фильтрами: как выбрать пять звонков из пятисот. Проверка сценария разговора — третья: проверка скрипта по записям. Четвёртая — где телефония держит записи и сколько их хранить. Всё, что ниже, — про архив целиком.
Что появляется, когда архив становится текстом
Разница между «записи есть» и «записями пользуются» — в том, читается ли архив глазами. Час аудио слушается час, час текста просматривается за пять минут, сотня часов текста обрабатывается запросом. Меняется способ работы: вместо «послушать разговоры» появляется «посчитать по разговорам».
Технически всё это одно действие: записи звонков превращаются в текст с разделением оператора и клиента и временем у каждой реплики. После этого архив перестаёт быть папкой с файлами и становится тем, по чему можно искать и считать.

Телефонный звук распознаётся хуже записи встречи — страдают фамилии, адреса и числительные, и это стоит помнить, цитируя разговор дословно (подробности — в статье про расшифровку телефонного разговора). На подсчёт долей это почти не влияет: причину обращения человек называет обычными словами.
Вопрос бизнеса → что искать в тексте звонков
Архив сам по себе ничего не отвечает — отвечает, когда к нему приходят с конкретным вопросом. Вот семь вопросов, которые чаще всего задают колл-центру, и то, что под каждым из них ищут в тексте разговоров.
| Вопрос бизнеса | Что искать в тексте звонков | Что с этим делать |
|---|---|---|
| Почему растёт нагрузка на линию | Первую минуту каждого разговора: с чем человек пришёл, его словами | Три самые частые причины — повестка на месяц для продукта и текстов на сайте |
| Из-за чего клиенты уходят | Звонки на отмену: что названо причиной до того, как оператор начал удерживать | Причины ухода словами клиентов, а не галочками из списка в карточке |
| Что непонятно в продукте | Вопросы «а как», «где найти», «а это входит» — и на каком шаге они возникают | Правки в интерфейс, инструкцию и письма: один частый вопрос — один экран |
| Какими словами говорят клиенты | Как люди называют продукт, тариф и проблему без ваших терминов | Заголовки на сайте, объявления, формулировки в справке и в скрипте |
| Что обещают операторы | Слова «сделаем исключение», «верну», «бесплатно», «завтра» и что стоит рядом | Сверка обещаний с тем, что произошло дальше; правка регламента, а не выговор |
| Растёт ли доля повторных обращений | Разговоры со словами «я уже звонил», «мне обещали», «второй раз за неделю» | Проблемы, которые не закрываются с первого раза, — самая дорогая строка |
| Что случилось в конкретной сделке | Поиск по номеру заказа, фамилии или дате — один разговор среди тысяч | Ответ на претензию за минуты, с цитатой и отметкой времени |
Ни один из этих вопросов не решается прослушиванием пяти записей: первые шесть требуют массы, последний — поиска. И то и другое появляется только после того, как разговоры стали текстом.
Как собрать список причин обращений, не выдумывая его
Рубрикатор обращений почти везде придуман заранее: пять-семь категорий, которые показались разумными на встрече. Через месяц половина обращений оказывается в графе «Прочее» — честный сигнал, что категории не описывают того, с чем звонят.
Собирают такой список в обратную сторону, снизу. Берёте первую минуту каждого разговора: там человек своими словами объясняет, зачем позвонил. Из тысячи формулировок складывается двадцать-тридцать устойчивых групп, мало похожих на придуманные пять.
- Называйте группу словами клиента. «Не пришёл код» — рабочее название, «Проблемы аутентификации» — нет: по первому вы через месяц найдёте разговоры, по второму будете вспоминать, что имели в виду.
- Одно обращение — одна причина. За разговор человек успевает спросить три вещи, но позвонил из-за одной. Считается та, с которой он начал: она и создала нагрузку на линию.
- Держите «Прочее» ниже десяти процентов. Выше — значит, в куче спряталась ещё одна большая группа, и её стоит вытащить.
- Пересобирайте раз в квартал. Список причин — снимок продукта на сегодня. Изменили оплату — через две недели в архиве появится новая группа, и увидеть её лучше сразу, а не в отчёте за полугодие.
Доли считают на всём массиве, а не на удобном куске: разница между 8 и 12 % — это разница, если за ней тысячи разговоров, и шум, если двадцать. Помогает то, что отчёт собирается сразу по группе записей: на выходе один документ по неделе, а не двести отдельных.
Дальше три верхние строки становятся работой. «Где мой заказ» на 15 % архива — это не тема для обучения операторов, а отсутствующее письмо со статусом. «Списали дважды» — вопрос к оплате, а не к тому, как оператор извиняется.

Слова клиентов: сырьё для продукта и рекламы
Второе, ради чего архив читают целиком, — язык. В компании продукт называют одним набором слов, клиенты — другим, и расходятся они сильнее, чем кажется изнутри: «личный кабинет» звучит в разговорах как «сайт, где я захожу», «тарифный план» — как «то, за что я плачу каждый месяц», «техническая поддержка» — как «вы».
Человек ищет теми же словами, которыми говорит по телефону, и узнаёт свою проблему в заголовке, только если тот написан на его языке. Архив звонков — место, где эти формулировки лежат в естественном виде и в количестве, достаточном, чтобы отличить частое от единичного.
- Заголовки и тексты на сайте. Возьмите десять самых частых формулировок проблемы и проверьте, встречается ли хоть одна на страницах, которые должны на эти проблемы отвечать.
- Объявления и справка. Слова из звонков — готовый список того, как вас ищут: вы не спрашиваете людей, как они говорят, а слышите это. Название статьи, совпадающее с фразой из звонка, находится в поиске по сайту; придуманное отделом — нет.
- Названия проблем в задачах. Задача «клиенты жалуются на оплату» не двигается. Задача «двадцать три звонка за неделю: списали дважды при оплате картой» двигается.
Отдельный приём — не читать, а спрашивать: вопрос «какими словами клиенты называют проблему с доставкой» задаётся по всему архиву сразу, а в ответ приходят цитаты с указанием разговора и минуты.

Найти один разговор среди тысяч
Третья задача — не про массу, а про точность. Приходит претензия: «Второго июля ваш оператор пообещал мне бесплатную замену». В аудиоархиве это полдня: выгрузить записи за второе июля, отфильтровать по номеру, слушать подряд. В текстовом — поиск по фамилии и слову «замена».
Важна не сама находка, а то, что с ней можно сделать. Цитата с отметкой времени закрывает спор быстрее любого пересказа: строка открывается, и слышно, как фраза прозвучала. Ответ клиенту при этом уходит в тот же день, а не через неделю.

Побочный эффект замечают не сразу: когда любой разговор находится за минуту, спор «я такого не говорил» заканчивается на первой цитате — и работает это в обе стороны, включая оператора, которого обвинили несправедливо.
Хранение и обезличивание: коротко и по делу
Запись разговора с клиентом — персональные данные, если по ней можно понять, кто это, а в колл-центре это почти всегда так: звучат имя, номер заказа, адрес доставки. Расшифровка ничего к этому не добавляет — тот же разговор в текстовом виде.
Два требования закона нарушаются здесь чаще всего по недосмотру. Первое: содержание и объём обрабатываемых данных не должны быть избыточными по отношению к целям обработки (ч. 5 ст. 5 ФЗ-152). Второе: хранить их в форме, позволяющей определить человека, можно «не дольше, чем этого требуют цели обработки», а по достижении целей данные подлежат уничтожению либо обезличиванию (ч. 7 ст. 5). Оба удобнее выполнять на тексте: из аудио номер карты не вырежешь, из расшифровки — вырежешь.
Обезличивание закон определяет буквально: «действия, в результате которых становится невозможным без использования дополнительной информации определить принадлежность персональных данных конкретному субъекту» (п. 9 ст. 3). На практике это значит, что в копии для аналитики остаётся суть обращения и не остаётся человека.
- Разведите два архива. Полные расшифровки живут рядом с записями и с теми же правами доступа, обезличенные копии — там, где с ними работают продукт и маркетинг. Смешивать их в одной папке «для удобства» — самый частый способ получить утечку на ровном месте.
- Убирайте не только имя. Телефон, адрес, номер заказа и договора, последние цифры карты, дату рождения — всё, по чему человека можно найти. Причина обращения остаётся целиком, а нужна вам именно она.
- Не заводите голосовые слепки просто так. Закон относит к биометрии сведения, характеризующие физиологические особенности человека, на основании которых можно установить его личность, и требует для их обработки письменного согласия (ч. 1 ст. 11). Разделение реплик на оператора и клиента внутри одной записи такой цели не ставит; узнавание конкретного человека по голосу между записями — ставит, и это отдельный разговор с отдельным согласием.
- Назначьте срок. У записей и расшифровок он должен быть один и осмысленный: столько, сколько нужно для претензии, спора или проверки. Дальше — удаление или обезличивание, по расписанию, а не когда закончится место на диске.
- Наружу выгружайте отчёт, а не текст. Подрядчику по рекламе нужны формулировки и доли, а не расшифровки разговоров.
С чего начать: одна неделя от начала до конца
Разворачивать это на весь архив сразу вредно — утонете на первом шаге. Берётся одна прошедшая неделя, целиком, и проходится от выгрузки до выводов: около пяти часов, размазанных по пяти дням.
- Понедельник, час. Выгрузите записи за одну прошедшую неделю целиком и отбросьте всё короче сорока секунд — недозвоны, обрывы, «ошиблись номером». Обычно уходит четверть списка, и это не потеря: разговора в таких файлах нет.
- Вторник. Отправьте оставшееся в расшифровку одной загрузкой. К среде у вас лежит текст с разделением оператора и клиента и временем у каждой реплики.
- Среда, два часа. Прочитайте первые пять реплик каждого разговора — только их; за два часа так проходится несколько сотен звонков. Причину выписывайте теми словами, которыми её назвал клиент.
- Четверг, час. Сложите похожие формулировки в группы и посчитайте доли. Получится первый рубрикатор — кривой, зато свой. Три верхние строки и есть повестка на месяц.
- Пятница, полчаса. Возьмите верхнюю причину и прочитайте по ней пять разговоров целиком. Здесь и находится ответ на вопрос «почему они звонят», которого не видно ни по одному счётчику.
- Через неделю. Повторите и сравните доли. Две точки показывают направление, с третьей начинается разговор о том, что чинить в продукте, а не в скрипте.
- Неделя записейвыгрузка целиком, без выборки
- Текстстороны разговора и время у реплик
- Причиныформулировки клиентов, сгруппированные
- Повесткатри верхние строки — в работу
После второго-третьего прохода процедура сжимается до пары часов в неделю. А папка, куда файлы складывали на всякий случай, превращается в общий архив разговоров команды — с поиском, отчётами и возможностью найти нужную минуту. У отдела продаж рядом та же задача на своих записях: разговоры с клиентами в текстовом виде.
Архив звонков, по которому можно искать и считать
Загрузите записи колл-центра: Vibe2Text вернёт текст с разделением оператора и клиента и таймкодами, соберёт отчёт сразу по группе разговоров и ответит на вопросы по архиву цитатами с отметками времени.
Расшифровать архив звонковБесплатный старт без карты, файлы до 4 ГБ и до 6 часов. Экспорт: DOCX, PDF, TXT, Markdown, JSON, SRT, VTT.
Частые вопросы
Что делать с записями разговоров, которых накопились тысячи?
Сначала перевести их в текст, потом задавать вопросы. Прослушивание работает, пока записей десятки; на тысячах оно упирается в рабочее время человека. Текстовый архив отвечает на другое: сколько раз за месяц звонили по каждой причине, какими словами люди описывают проблему, где лежит разговор от второго июля.
Обязательно ли расшифровывать все звонки?
Для подсчёта долей — да: на выборке в сорок разговоров разница между 8 и 12 % неотличима от случайности. Рабочий компромисс — расшифровывать поток целиком, а читать только то, что попало в верхние причины или нужно по конкретному спору.
Как анализировать звонки клиентов, если их тысячи в месяц?
Считать, а не слушать. Разговоры переводятся в текст, из первой минуты каждого выписывается причина обращения словами клиента, похожие формулировки складываются в группы — и получается список причин с долями. Дальше по нему видно, что чинить: три верхние строки обычно объясняют больше половины нагрузки на линию.
Как контролировать качество звонков, если слушать всё невозможно?
Разделить две вещи. Оценка отдельного разговора по чек-листу остаётся выборочной — это работа руководителя, и записи для неё отбирают по сигналам, а не наугад. Сплошные признаки — закончился ли разговор договорённостью, прозвучало ли обещание вне регламента, был ли перевод на другую линию — считаются по тексту всего архива и прослушивания не требуют.
Что делать с персональными данными в записях звонков?
Держать два вида копий. Полные расшифровки — с теми же правами доступа, что и записи. Для аналитики — обезличенные, без имени, телефона, адреса, номеров заказа и карты: закон определяет обезличивание как действия, после которых принадлежность данных конкретному человеку нельзя определить без дополнительной информации. Причина обращения сохраняется полностью, а она и нужна для подсчётов.
Сколько хранить записи и расшифровки?
Столько, сколько требуют цели, ради которых их собрали, — обычно это срок возможной претензии или проверки. Закон требует не хранить данные в форме, позволяющей определить человека, дольше, чем нужно для целей обработки, а по достижении целей — уничтожить либо обезличить. Срок задаётся один раз и исполняется по расписанию, а не по остатку места на диске.
Проверено 14 августа 2026 по действующей редакции Федерального закона от 27.07.2006 № 152-ФЗ «О персональных данных»: определение обезличивания — п. 9 ст. 3; запрет на избыточность обрабатываемых данных — ч. 5 ст. 5; хранение не дольше, чем требуют цели обработки, с уничтожением либо обезличиванием по их достижении — ч. 7 той же статьи; биометрические персональные данные и письменное согласие на их обработку — ч. 1 ст. 11. Объём архива посчитан по названным в тексте условиям (20 операторов, 40 разговоров в день, 4 минуты, 22 рабочих дня); доли причин обращений в схемах — иллюстративные.