
ГАЙД
Анализ пользовательских интервью: от расшифровок к паттернам за один день
Восемь расшифровок — это ещё не результат. Как размечать реплики кодами, собирать их в темы, считать участников по матрице и не дать одному яркому интервью перевесить остальные семь.
Как анализировать глубинные интервью, когда их восемь и все расшифрованы
Восемь разговоров по часу — это около ста тысяч знаков текста и обманчивое чувство, что работа сделана. Сделана подготовка. Вопрос «как анализировать глубинные интервью» начинается ровно здесь: расшифровки есть, выводов нет, и между ними лежит ремесло со своими шагами, которые нельзя перепрыгнуть без потери качества.
Дальше — про каждый уровень отдельно, про матрицу и про ловушку, в которую попадают все: одно яркое интервью помнится лучше семи остальных, и выводы незаметно съезжают к нему. Речь про интервью один на один в продуктовом исследовании; разбор групповых сессий устроен иначе — там сравнивают группы между собой, и это отдельная работа: как анализировать фокус-группу.
Что человек сказал и что он имел в виду: четыре уровня
Самая частая беда исследовательского отчёта — смешение уровней в одном предложении. «Пользователи не понимают, что подписка уже оформлена» звучит как факт, а на самом деле это интерпретация, построенная на двух наблюдениях. Отличить одно от другого через месяц уже невозможно, и защищать такой отчёт нечем.
| Уровень | Как это выглядит | Что с этим делать |
|---|---|---|
| Дословно | «Я три раза нажал, и ничего не произошло» | Цитировать, проверять по таймкоду |
| Наблюдение | Нажал кнопку трижды подряд, потом ушёл в меню | Спорить можно только о том, что видно в записи |
| Интерпретация | Не понял, что действие уже выполнено | Помечать как гипотезу, обсуждать с командой |
| Вывод | Нужен видимый отклик на нажатие | Проверять другими методами, а не защищать |
Практическое правило простое: держите уровни визуально раздельно. Дословные цитаты — в кавычках и с таймкодом, наблюдения — обычным текстом, интерпретации — с явной пометкой вроде «похоже, что». Команда должна видеть, где кончается запись и начинается ваша голова, — иначе первый же спор превратится в спор о доверии к исследователю.
Открытое кодирование: как размечать реплики
Код — это короткая пометка на фрагменте текста: что здесь происходит с точки зрения вашего исследовательского вопроса. Не пересказ и не оценка, а ярлык, по которому потом можно собрать все похожие места из всех интервью. «Не нашёл кнопку экспорта», «сравнивает с прежним инструментом», «боится потерять данные» — типичные коды первого прохода.
- Начните с одного интервью и не спешите обобщать. Первый проход по первой расшифровке — это тридцать-пятьдесят кодов, из которых половина потом схлопнется. Это нормально: цель прохода — увидеть, что вообще есть в материале.
- Берите единицей смысл, а не абзац. Одна реплика может нести два кода, а три реплики подряд — один. Ориентир: кусок, который можно вынуть и показать коллеге отдельно, и он останется понятным.
- Держите коды словами респондента, где получается. «Ещё один аккаунт» как код точнее, чем «барьер регистрации»: во втором вы уже начали интерпретировать, а до этого этапа ещё далеко.
- Заведите кодбук с первого дня. Список кодов с одной строкой описания и одним примером. Без него на четвёртом интервью вы заведёте синоним того, что уже кодировали на первом, и обе кучки окажутся вдвое меньше настоящей.
- Не кодируйте всё подряд. Вступление, разговоры про погоду и уточнение процедуры кодировать не нужно. Если размечено больше половины текста, скорее всего, коды слишком общие.
- Кодируйте по тексту, слушая спорные места. По расшифровке идти в разы быстрее, чем по записи, но интонацию текст не передаёт: там, где смысл зависит от «ну да-а-а», фрагмент стоит переслушать.

Инструмент здесь вторичен: подходит и таблица из четырёх колонок — цитата, код, участник, таймкод. Важно другое: текст интервью должен быть пригоден для кодирования — с разделением реплик респондента и модератора и с отметками времени. Без таймкода код превращается в заметку, которую нельзя проверить, и вся дальнейшая цепочка теряет опору.
Из кодов в темы: группировка и название
Второй проход — сборка. Классическая рамка тематического анализа (Браун и Кларк, 2006) описывает шесть фаз: погружение в материал, порождение первичных кодов, поиск тем, проверка тем, определение и наименование тем, написание отчёта. На практике в продуктовом исследовании вся ценность концентрируется в третьей и четвёртой.
Дальше — три правила, которые отличают рабочую тему от папки с цитатами.
- Название — утверждение, а не ярлык. «Онбординг» ни о чём не говорит. «Не понимают, с чего начать после регистрации» — уже говорит, и по нему видно, подтверждается тема или нет.
- У темы есть границы. Должно быть понятно, какая реплика в неё не попадает. Тема, куда влезает всё, — признак того, что она слишком общая.
- Тема переживает проверку обратным ходом. Возьмите название и пройдите по всем закодированным фрагментам заново: если половина туда не тянется, тему надо делить.
Отдельно про негативные случаи. Участник, который сделал ровно наоборот, — не помеха теме, а самое ценное, что в ней есть: он показывает границу. Такие фрагменты стоит собирать в отдельную колонку и приносить на дебриф вместе с темой, а не вместо неё.
Матрица «участник × тема»: сколько людей стоит за выводом
Когда темы названы, собирается таблица: строки — темы, столбцы — участники, в ячейке отметка, встречалась ли тема у этого человека. Пять минут работы, а меняет она многое: становится видно, какая тема держится на шести участниках из восьми, а какая — на одном, зато очень убедительном.
Чего с этой матрицей делать не нужно — считать проценты. «62,5 % пользователей не находят вход» на выборке из восьми человек — это не статистика, а цифра, которая её изображает. Качественное исследование отвечает на вопросы «что бывает» и «почему», но не на вопрос «как часто»; для второго нужен другой метод и другая выборка.
Проверка кода по всему массиву: где ещё это звучало
У кодирования есть шаг, который пропускают чаще всего, — обратная проверка. Вы завели код на четвёртом интервью, и теперь надо понять, звучало ли то же самое в первых трёх, где вы просто не были к этому чувствительны. Перечитывать восемь расшифровок ради одного кода никто не станет — поэтому в ручном режиме этот шаг просто не делают.

Здесь выручают две вещи, и обе сокращают перебор, а не делают выводы. Первая — поиск сразу по всей волне: вводите формулировку кода и получаете места, где похожее произносили, с указанием интервью. Вторая — вопрос к записям своими словами, вроде «кто-нибудь говорил, что боится потерять данные», в ответ на который приходят цитаты с отметками секунд. Дальше читаете найденное и решаете сами: это тот же код, соседний или просто совпали слова при другом смысле.
- Прогон нового кода по старым интервью. Заводите код — сразу проверяйте предыдущие расшифровки. Иначе тема будет выглядеть слабее, чем есть.
- Поиск противоположного. Нашли тему — поищите слова, которыми её бы опровергли. «Наоборот», «зато», «мне как раз удобно». Негативные случаи так находятся быстрее всего.
- Сверка формулировок. Одно и то же люди называют разными словами. Список синонимов, которыми респонденты описывают вашу категорию, — побочный, но очень полезный продукт кодирования.
Ловушка яркого интервью: почему выводы съезжают к одному человеку
Это происходит с каждым и почти незаметно. Один респондент говорил ярко, эмоционально и в тему, вы вышли с ощущением «вот оно» — и весь дальнейший анализ подсознательно строится вокруг этого разговора. Механизм давно описан: эвристика доступности (Тверски и Канеман, 1973) — мы оцениваем, насколько часто что-то встречается, по тому, как легко это вспоминается. Ярко рассказанное вспоминается легче, значит, кажется более частым.
Второй сорт той же ошибки — цитата, которая слишком хорошо звучит. Красивая фраза попадает в отчёт не потому, что типична, а потому что её приятно показывать. Дешёвое противоядие: рядом с каждой цитатой в черновике проставляйте, сколько ещё участников говорили нечто похожее. Одинокие красивые цитаты после этого отсеиваются сами.
Сколько интервью нужно: про насыщение без магических чисел
Опорная точка в этом разговоре одна и старая. Гест, Банс и Джонсон (Field Methods, 2006) взяли шестьдесят глубинных интервью и посмотрели, на каком шаге перестают появляться новые темы: насыщение наступило в пределах первых двенадцати интервью, а основные элементы просматривались уже после шести. Это не закон природы, а результат на однородной выборке с одним гайдом — но как ориентир он держится двадцать лет.
| Юзабилити-тест | Глубинное интервью | |
|---|---|---|
| Что ищем | где спотыкаются в интерфейсе | как устроена задача и почему |
| Сколько участников | пять на итерацию, дальше повтор | до насыщения, ориентир — двенадцать |
| Что даёт шестой | почти ничего нового | иногда новую тему |
| Единица анализа | найденная проблема | код и тема |
Правую и левую колонку регулярно путают, и отсюда берётся спор «зачем восемь интервью, Нильсен же писал про пятерых». Правило пяти участников — про юзабилити-тестирование, где пятеро находят порядка 85 % проблем интерфейса, а бюджет советуют тратить на три исследования по пять человек вместо одного на пятнадцать. К выяснению того, как у людей устроена задача, это правило отношения не имеет.
Практический критерий насыщения проще академического: заведите счётчик новых кодов по каждому интервью. Восьмое интервью принесло два новых кода вместо пятнадцати — вы близко. Принесло восемь — выборка неоднородна, и, скорее всего, вы разговариваете уже с другим сегментом, для которого счёт начинается заново.
Дебриф: что показывать команде и как спорить с продактом
На дебрифе исследование либо становится решением, либо остаётся документом. Разница обычно не в качестве анализа, а в том, что именно вы вынесли на экран. Пересказ восьми интервью не работает: через десять минут команда помнит одну историю, и это будет та, которую вы рассказали эмоциональнее прочих.
- Тема одним утверждением. Заголовок слайда — то, что вы утверждаете, а не название раздела.
- Сколько участников за ней стоит. «Шесть из восьми» рядом с темой снимает половину вопросов до того, как их зададут.
- Две дословные цитаты с таймкодом. Разных людей, не самые красивые, а самые типичные.
- Негативный случай. «У одного было наоборот, вот почему» — это то, что отличает исследование от подбора доказательств.
- Что это меняет. Одна строка: какое решение зависит от этой темы. Если ни одно — тема на дебриф не выносится.
- Список гипотез отдельно. Всё, что держится на одном участнике, живёт в конце и называется своим именем.

И главный практический приём: цитата с таймкодом — это то, чем заканчивается спор. Когда продакт говорит «да они просто не разобрались», ответ не «нет, они не поняли навигацию», а открытая запись на четырнадцатой минуте, где человек полторы минуты ищет кнопку и проговаривает вслух, что делает. Пересказ такой спор не выигрывает никогда — а тридцать секунд записи заканчивают его сразу. Черновую сводку по каждой записи удобно готовить отчётом по своему шаблону, чтобы структура была одинаковой у всех восьми.
Как уложить разбор восьми интервью в один день
План, который работает, если расшифровки уже готовы, а гайд был один на всех.
- Первые два часакодируем два интервью, заводим кодбук
- До обедаостальные шесть, кодбук почти не растёт
- Час послесхлопываем коды, называем темы
- Два часаматрица, цитаты, негативные случаи
Что съедает время сверх плана: ручной набор текста и поиск фрагментов на слух. Первое закрывается расшифровкой заранее — механика разобрана в статье как сделать стенограмму интервью. Второе — тем, что у каждой реплики есть время, и переход к нужной секунде занимает один клик, а не три минуты перемотки.

И привычка, которая окупается в следующей волне: называйте файлы одинаково — дата, код респондента, сегмент. Через полгода, когда придёт вопрос «а мы это уже спрашивали», архив расшифровок ответит за минуту. Если исследования идут потоком и интервью не восемь, а сорок, порядок работы с массивом разобран здесь: расшифровка кастдев-интервью.
Интервью записаны — анализ впереди
Загрузите записи: Vibe2Text вернёт текст с разделением респондента и модератора и таймкодом у каждой реплики — материал, по которому можно кодировать, искать формулировки и цитировать с проверкой по записи.
Подготовить интервью к анализуБесплатный старт без карты. Файлы до 4 ГБ и до 6 часов, русский и английский. Экспорт: DOCX, PDF, Markdown, TXT, SRT, VTT, JSON.
Частые вопросы
С чего начать анализ, если интервью восемь и все расшифрованы?
С кодирования первого интервью, а не с отчёта. Первый проход даёт тридцать-пятьдесят коротких пометок и черновой кодбук; на втором интервью список почти не растёт, дальше идёт быстро. Только после того, как размечены все восемь, коды схлопываются в темы, и лишь затем пишутся выводы. Попытка начать с выводов даёт красивый документ, который разваливается на первом же вопросе «а откуда это следует».
Чем код отличается от темы в кодировании интервью?
Код — пометка на конкретном фрагменте: «не нашёл кнопку экспорта». Тема — утверждение, которое объединяет несколько разных кодов и повторяется у разных людей: «не находят вход в основной сценарий». Код живёт внутри одного интервью, тема существует только поперёк массива. Если у вас пятьдесят «тем», это ещё коды.
Сколько глубинных интервью нужно провести?
Ориентир из классической работы Геста, Банса и Джонсона (2006): на однородной выборке с одним гайдом насыщение наступало в пределах двенадцати интервью, а основные темы просматривались уже после шести. Практический критерий проще: считайте новые коды по каждому интервью. Пока восьмое приносит десять новых кодов, вы не насытились; когда приносит один-два — можно останавливаться.
Можно ли считать проценты по итогам восьми интервью?
Нет. «Шесть участников из восьми» — честная формулировка, «75 % пользователей» — нет: это выдаёт качественную выборку за количественную. Качественное исследование отвечает на вопросы «что бывает» и «как устроено», а частоты меряют опросом на другой выборке. Матрица «участник × тема» нужна ровно для того, чтобы говорить абсолютными числами и не терять при этом опору.
Как отличить, что человек сказал, от того, что он имел в виду?
Разложите утверждение на уровни: дословная реплика, наблюдаемое поведение, ваша интерпретация, вывод. В отчёте они должны быть видимо разными — цитата в кавычках с таймкодом, интерпретация с пометкой «похоже, что». Проверка: к каждому утверждению найдите реплику, из которой оно выросло. Не нашлась за десять секунд — это пока впечатление.
Что делать, если одно интервью запомнилось ярче остальных?
Считать это известной ошибкой восприятия и обходить процедурой. Заканчивать кодирование до устного обсуждения с командой, второй проход начинать с последнего интервью, а перед каждым выводом смотреть строку матрицы: сколько участников за ним стоит. Тема, которая держится на одном ярком респонденте, идёт в отчёт в раздел гипотез.
Может ли ИИ сделать анализ интервью за исследователя?
Он снимает механическую часть: даёт текст с таймкодами, находит формулировку сразу во всех расшифровках, отвечает на вопрос по содержанию с цитатами и готовит черновую сводку по записи. Кодирование, границы тем, интерпретация и решение о том, что считать находкой, а что гипотезой, остаются человеческой работой — именно за них исследователю и платят.
Проверено 15 августа 2026: рамка тематического анализа и шесть её фаз — Braun V., Clarke V. «Using thematic analysis in psychology», Qualitative Research in Psychology, 2006. Данные о насыщении — Guest G., Bunce A., Johnson L. «How Many Interviews Are Enough? An Experiment with Data Saturation and Variability», Field Methods, 18(1), 2006 (60 интервью; насыщение в пределах первых двенадцати, основные элементы после шести). Правило пяти участников в юзабилити-тестировании и оценка 85 % найденных проблем — по материалу Nielsen Norman Group «Why You Only Need to Test with 5 Users». Механизм переоценки ярко запомнившегося — Tversky A., Kahneman D. «Availability: A Heuristic for Judging Frequency and Probability», Cognitive Psychology, 1973.