Анализ пользовательских интервью: от расшифровок к паттернам за один день

ГАЙД

Анализ пользовательских интервью: от расшифровок к паттернам за один день

Восемь расшифровок — это ещё не результат. Как размечать реплики кодами, собирать их в темы, считать участников по матрице и не дать одному яркому интервью перевесить остальные семь.

Как анализировать глубинные интервью, когда их восемь и все расшифрованы

Восемь разговоров по часу — это около ста тысяч знаков текста и обманчивое чувство, что работа сделана. Сделана подготовка. Вопрос «как анализировать глубинные интервью» начинается ровно здесь: расшифровки есть, выводов нет, и между ними лежит ремесло со своими шагами, которые нельзя перепрыгнуть без потери качества.

Четыре уровня, между которыми легко проскочить. Ошибка стоит дорого именно на переходах: вывод, сделанный сразу из реплики, потом невозможно ни защитить, ни проверить.

Дальше — про каждый уровень отдельно, про матрицу и про ловушку, в которую попадают все: одно яркое интервью помнится лучше семи остальных, и выводы незаметно съезжают к нему. Речь про интервью один на один в продуктовом исследовании; разбор групповых сессий устроен иначе — там сравнивают группы между собой, и это отдельная работа: как анализировать фокус-группу.

Что человек сказал и что он имел в виду: четыре уровня

Самая частая беда исследовательского отчёта — смешение уровней в одном предложении. «Пользователи не понимают, что подписка уже оформлена» звучит как факт, а на самом деле это интерпретация, построенная на двух наблюдениях. Отличить одно от другого через месяц уже невозможно, и защищать такой отчёт нечем.

УровеньКак это выглядитЧто с этим делать
Дословно«Я три раза нажал, и ничего не произошло»Цитировать, проверять по таймкоду
НаблюдениеНажал кнопку трижды подряд, потом ушёл в менюСпорить можно только о том, что видно в записи
ИнтерпретацияНе понял, что действие уже выполненоПомечать как гипотезу, обсуждать с командой
ВыводНужен видимый отклик на нажатиеПроверять другими методами, а не защищать

Практическое правило простое: держите уровни визуально раздельно. Дословные цитаты — в кавычках и с таймкодом, наблюдения — обычным текстом, интерпретации — с явной пометкой вроде «похоже, что». Команда должна видеть, где кончается запись и начинается ваша голова, — иначе первый же спор превратится в спор о доверии к исследователю.

Открытое кодирование: как размечать реплики

Код — это короткая пометка на фрагменте текста: что здесь происходит с точки зрения вашего исследовательского вопроса. Не пересказ и не оценка, а ярлык, по которому потом можно собрать все похожие места из всех интервью. «Не нашёл кнопку экспорта», «сравнивает с прежним инструментом», «боится потерять данные» — типичные коды первого прохода.

  1. Начните с одного интервью и не спешите обобщать. Первый проход по первой расшифровке — это тридцать-пятьдесят кодов, из которых половина потом схлопнется. Это нормально: цель прохода — увидеть, что вообще есть в материале.
  2. Берите единицей смысл, а не абзац. Одна реплика может нести два кода, а три реплики подряд — один. Ориентир: кусок, который можно вынуть и показать коллеге отдельно, и он останется понятным.
  3. Держите коды словами респондента, где получается. «Ещё один аккаунт» как код точнее, чем «барьер регистрации»: во втором вы уже начали интерпретировать, а до этого этапа ещё далеко.
  4. Заведите кодбук с первого дня. Список кодов с одной строкой описания и одним примером. Без него на четвёртом интервью вы заведёте синоним того, что уже кодировали на первом, и обе кучки окажутся вдвое меньше настоящей.
  5. Не кодируйте всё подряд. Вступление, разговоры про погоду и уточнение процедуры кодировать не нужно. Если размечено больше половины текста, скорее всего, коды слишком общие.
  6. Кодируйте по тексту, слушая спорные места. По расшифровке идти в разы быстрее, чем по записи, но интонацию текст не передаёт: там, где смысл зависит от «ну да-а-а», фрагмент стоит переслушать.
Расшифровка глубинного интервью: реплики респондента и модератора с таймкодами для кодирования
Слова респондента отделены от вопросов модератора, рядом с каждой репликой — отметка времени. Код ставится на конкретный фрагмент и уносит с собой адрес: к какой секунде вернуться, когда вывод оспорят.

Инструмент здесь вторичен: подходит и таблица из четырёх колонок — цитата, код, участник, таймкод. Важно другое: текст интервью должен быть пригоден для кодирования — с разделением реплик респондента и модератора и с отметками времени. Без таймкода код превращается в заметку, которую нельзя проверить, и вся дальнейшая цепочка теряет опору.

Из кодов в темы: группировка и название

Второй проход — сборка. Классическая рамка тематического анализа (Браун и Кларк, 2006) описывает шесть фаз: погружение в материал, порождение первичных кодов, поиск тем, проверка тем, определение и наименование тем, написание отчёта. На практике в продуктовом исследовании вся ценность концентрируется в третьей и четвёртой.

Тема — это то, что объединяет несколько кодов, а не самый частый из них. Проверка на прочность: если из темы нельзя вывести решение, это ещё категория, а не тема.

Дальше — три правила, которые отличают рабочую тему от папки с цитатами.

  • Название — утверждение, а не ярлык. «Онбординг» ни о чём не говорит. «Не понимают, с чего начать после регистрации» — уже говорит, и по нему видно, подтверждается тема или нет.
  • У темы есть границы. Должно быть понятно, какая реплика в неё не попадает. Тема, куда влезает всё, — признак того, что она слишком общая.
  • Тема переживает проверку обратным ходом. Возьмите название и пройдите по всем закодированным фрагментам заново: если половина туда не тянется, тему надо делить.

Отдельно про негативные случаи. Участник, который сделал ровно наоборот, — не помеха теме, а самое ценное, что в ней есть: он показывает границу. Такие фрагменты стоит собирать в отдельную колонку и приносить на дебриф вместе с темой, а не вместо неё.

Матрица «участник × тема»: сколько людей стоит за выводом

Когда темы названы, собирается таблица: строки — темы, столбцы — участники, в ячейке отметка, встречалась ли тема у этого человека. Пять минут работы, а меняет она многое: становится видно, какая тема держится на шести участниках из восьми, а какая — на одном, зато очень убедительном.

Заполненная строка — тема, за которой стоят люди. Одна закрашенная ячейка — сигнал, который стоит проверить в следующей волне, а не вывод для дорожной карты.

Чего с этой матрицей делать не нужно — считать проценты. «62,5 % пользователей не находят вход» на выборке из восьми человек — это не статистика, а цифра, которая её изображает. Качественное исследование отвечает на вопросы «что бывает» и «почему», но не на вопрос «как часто»; для второго нужен другой метод и другая выборка.

Проверка кода по всему массиву: где ещё это звучало

У кодирования есть шаг, который пропускают чаще всего, — обратная проверка. Вы завели код на четвёртом интервью, и теперь надо понять, звучало ли то же самое в первых трёх, где вы просто не были к этому чувствительны. Перечитывать восемь расшифровок ради одного кода никто не станет — поэтому в ручном режиме этот шаг просто не делают.

Панель вопросов к записи интервью: запрос по содержанию всех расшифровок сразу
Спросить можно так же, как спросили бы коллегу, который прослушал все восемь записей. Ответ приходит с цитатами и отметками секунд — и служит списком мест для чтения, а не заменой кодированию.

Здесь выручают две вещи, и обе сокращают перебор, а не делают выводы. Первая — поиск сразу по всей волне: вводите формулировку кода и получаете места, где похожее произносили, с указанием интервью. Вторая — вопрос к записям своими словами, вроде «кто-нибудь говорил, что боится потерять данные», в ответ на который приходят цитаты с отметками секунд. Дальше читаете найденное и решаете сами: это тот же код, соседний или просто совпали слова при другом смысле.

  • Прогон нового кода по старым интервью. Заводите код — сразу проверяйте предыдущие расшифровки. Иначе тема будет выглядеть слабее, чем есть.
  • Поиск противоположного. Нашли тему — поищите слова, которыми её бы опровергли. «Наоборот», «зато», «мне как раз удобно». Негативные случаи так находятся быстрее всего.
  • Сверка формулировок. Одно и то же люди называют разными словами. Список синонимов, которыми респонденты описывают вашу категорию, — побочный, но очень полезный продукт кодирования.

Ловушка яркого интервью: почему выводы съезжают к одному человеку

Это происходит с каждым и почти незаметно. Один респондент говорил ярко, эмоционально и в тему, вы вышли с ощущением «вот оно» — и весь дальнейший анализ подсознательно строится вокруг этого разговора. Механизм давно описан: эвристика доступности (Тверски и Канеман, 1973) — мы оцениваем, насколько часто что-то встречается, по тому, как легко это вспоминается. Ярко рассказанное вспоминается легче, значит, кажется более частым.

Разница между двумя строками — единственное, ради чего стоит заполнять матрицу. Она уравнивает вес участников: каждый даёт одну отметку независимо от того, насколько складно говорил.
Кодировать до дебрифаРазметку заканчивают до того, как обсудили результаты с командой вслух. После обсуждения вы кодируете уже под сложившуюся историю, а не под материал.
Идти в обратном порядкеВторой проход по расшифровкам начинайте с последнего интервью. Порядок ломает накопленную инерцию, и слабые темы из первых разговоров перестают теряться.
Считать участниковПеред каждым выводом смотрите строку матрицы. Если за темой стоит один человек, в отчёте она идёт в раздел гипотез, а не находок.

Второй сорт той же ошибки — цитата, которая слишком хорошо звучит. Красивая фраза попадает в отчёт не потому, что типична, а потому что её приятно показывать. Дешёвое противоядие: рядом с каждой цитатой в черновике проставляйте, сколько ещё участников говорили нечто похожее. Одинокие красивые цитаты после этого отсеиваются сами.

Сколько интервью нужно: про насыщение без магических чисел

Опорная точка в этом разговоре одна и старая. Гест, Банс и Джонсон (Field Methods, 2006) взяли шестьдесят глубинных интервью и посмотрели, на каком шаге перестают появляться новые темы: насыщение наступило в пределах первых двенадцати интервью, а основные элементы просматривались уже после шести. Это не закон природы, а результат на однородной выборке с одним гайдом — но как ориентир он держится двадцать лет.

Юзабилити-тестГлубинное интервью
Что ищемгде спотыкаются в интерфейсекак устроена задача и почему
Сколько участниковпять на итерацию, дальше повтордо насыщения, ориентир — двенадцать
Что даёт шестойпочти ничего новогоиногда новую тему
Единица анализанайденная проблемакод и тема

Правую и левую колонку регулярно путают, и отсюда берётся спор «зачем восемь интервью, Нильсен же писал про пятерых». Правило пяти участников — про юзабилити-тестирование, где пятеро находят порядка 85 % проблем интерфейса, а бюджет советуют тратить на три исследования по пять человек вместо одного на пятнадцать. К выяснению того, как у людей устроена задача, это правило отношения не имеет.

Практический критерий насыщения проще академического: заведите счётчик новых кодов по каждому интервью. Восьмое интервью принесло два новых кода вместо пятнадцати — вы близко. Принесло восемь — выборка неоднородна, и, скорее всего, вы разговариваете уже с другим сегментом, для которого счёт начинается заново.

Дебриф: что показывать команде и как спорить с продактом

На дебрифе исследование либо становится решением, либо остаётся документом. Разница обычно не в качестве анализа, а в том, что именно вы вынесли на экран. Пересказ восьми интервью не работает: через десять минут команда помнит одну историю, и это будет та, которую вы рассказали эмоциональнее прочих.

  1. Тема одним утверждением. Заголовок слайда — то, что вы утверждаете, а не название раздела.
  2. Сколько участников за ней стоит. «Шесть из восьми» рядом с темой снимает половину вопросов до того, как их зададут.
  3. Две дословные цитаты с таймкодом. Разных людей, не самые красивые, а самые типичные.
  4. Негативный случай. «У одного было наоборот, вот почему» — это то, что отличает исследование от подбора доказательств.
  5. Что это меняет. Одна строка: какое решение зависит от этой темы. Если ни одно — тема на дебриф не выносится.
  6. Список гипотез отдельно. Всё, что держится на одном участнике, живёт в конце и называется своим именем.
Панель сборки отчёта по записям интервью: краткое резюме или разбор по своему шаблону
Черновик сводки по записи собирается автоматически и экономит первый час. Дальше это заготовка для рук исследователя: темы, приоритеты и формулировки остаются человеческой работой.

И главный практический приём: цитата с таймкодом — это то, чем заканчивается спор. Когда продакт говорит «да они просто не разобрались», ответ не «нет, они не поняли навигацию», а открытая запись на четырнадцатой минуте, где человек полторы минуты ищет кнопку и проговаривает вслух, что делает. Пересказ такой спор не выигрывает никогда — а тридцать секунд записи заканчивают его сразу. Черновую сводку по каждой записи удобно готовить отчётом по своему шаблону, чтобы структура была одинаковой у всех восьми.

Как уложить разбор восьми интервью в один день

План, который работает, если расшифровки уже готовы, а гайд был один на всех.

  1. Первые два часакодируем два интервью, заводим кодбук
  2. До обедаостальные шесть, кодбук почти не растёт
  3. Час послесхлопываем коды, называем темы
  4. Два часаматрица, цитаты, негативные случаи

Что съедает время сверх плана: ручной набор текста и поиск фрагментов на слух. Первое закрывается расшифровкой заранее — механика разобрана в статье как сделать стенограмму интервью. Второе — тем, что у каждой реплики есть время, и переход к нужной секунде занимает один клик, а не три минуты перемотки.

Выгрузка расшифровок интервью в DOCX, PDF, Markdown и другие форматы для отчёта и архива
Текст уходит в DOCX или PDF для отчёта, в Markdown — в базу знаний команды, в TXT и JSON — туда, где его будут разбирать дальше. Записи с кодами живут в архиве и ищутся через полгода.

И привычка, которая окупается в следующей волне: называйте файлы одинаково — дата, код респондента, сегмент. Через полгода, когда придёт вопрос «а мы это уже спрашивали», архив расшифровок ответит за минуту. Если исследования идут потоком и интервью не восемь, а сорок, порядок работы с массивом разобран здесь: расшифровка кастдев-интервью.

Интервью записаны — анализ впереди

Загрузите записи: Vibe2Text вернёт текст с разделением респондента и модератора и таймкодом у каждой реплики — материал, по которому можно кодировать, искать формулировки и цитировать с проверкой по записи.

Подготовить интервью к анализу

Бесплатный старт без карты. Файлы до 4 ГБ и до 6 часов, русский и английский. Экспорт: DOCX, PDF, Markdown, TXT, SRT, VTT, JSON.

Частые вопросы

С чего начать анализ, если интервью восемь и все расшифрованы?

С кодирования первого интервью, а не с отчёта. Первый проход даёт тридцать-пятьдесят коротких пометок и черновой кодбук; на втором интервью список почти не растёт, дальше идёт быстро. Только после того, как размечены все восемь, коды схлопываются в темы, и лишь затем пишутся выводы. Попытка начать с выводов даёт красивый документ, который разваливается на первом же вопросе «а откуда это следует».

Чем код отличается от темы в кодировании интервью?

Код — пометка на конкретном фрагменте: «не нашёл кнопку экспорта». Тема — утверждение, которое объединяет несколько разных кодов и повторяется у разных людей: «не находят вход в основной сценарий». Код живёт внутри одного интервью, тема существует только поперёк массива. Если у вас пятьдесят «тем», это ещё коды.

Сколько глубинных интервью нужно провести?

Ориентир из классической работы Геста, Банса и Джонсона (2006): на однородной выборке с одним гайдом насыщение наступало в пределах двенадцати интервью, а основные темы просматривались уже после шести. Практический критерий проще: считайте новые коды по каждому интервью. Пока восьмое приносит десять новых кодов, вы не насытились; когда приносит один-два — можно останавливаться.

Можно ли считать проценты по итогам восьми интервью?

Нет. «Шесть участников из восьми» — честная формулировка, «75 % пользователей» — нет: это выдаёт качественную выборку за количественную. Качественное исследование отвечает на вопросы «что бывает» и «как устроено», а частоты меряют опросом на другой выборке. Матрица «участник × тема» нужна ровно для того, чтобы говорить абсолютными числами и не терять при этом опору.

Как отличить, что человек сказал, от того, что он имел в виду?

Разложите утверждение на уровни: дословная реплика, наблюдаемое поведение, ваша интерпретация, вывод. В отчёте они должны быть видимо разными — цитата в кавычках с таймкодом, интерпретация с пометкой «похоже, что». Проверка: к каждому утверждению найдите реплику, из которой оно выросло. Не нашлась за десять секунд — это пока впечатление.

Что делать, если одно интервью запомнилось ярче остальных?

Считать это известной ошибкой восприятия и обходить процедурой. Заканчивать кодирование до устного обсуждения с командой, второй проход начинать с последнего интервью, а перед каждым выводом смотреть строку матрицы: сколько участников за ним стоит. Тема, которая держится на одном ярком респонденте, идёт в отчёт в раздел гипотез.

Может ли ИИ сделать анализ интервью за исследователя?

Он снимает механическую часть: даёт текст с таймкодами, находит формулировку сразу во всех расшифровках, отвечает на вопрос по содержанию с цитатами и готовит черновую сводку по записи. Кодирование, границы тем, интерпретация и решение о том, что считать находкой, а что гипотезой, остаются человеческой работой — именно за них исследователю и платят.

Проверено 15 августа 2026: рамка тематического анализа и шесть её фаз — Braun V., Clarke V. «Using thematic analysis in psychology», Qualitative Research in Psychology, 2006. Данные о насыщении — Guest G., Bunce A., Johnson L. «How Many Interviews Are Enough? An Experiment with Data Saturation and Variability», Field Methods, 18(1), 2006 (60 интервью; насыщение в пределах первых двенадцати, основные элементы после шести). Правило пяти участников в юзабилити-тестировании и оценка 85 % найденных проблем — по материалу Nielsen Norman Group «Why You Only Need to Test with 5 Users». Механизм переоценки ярко запомнившегося — Tversky A., Kahneman D. «Availability: A Heuristic for Judging Frequency and Probability», Cognitive Psychology, 1973.