
ГАЙД
Расшифровка подкаста: шоуноты, тайм-коды и текст, который ищется
Час разговора живёт неделю в ленте, а потом теряется даже для вас. Как получить текст выпуска со спикерами и тайм-кодами и собрать из него шоуноты, статью и цитаты.
Выпуск вышел — и на этом всё
Эпизод выложили в понедельник, за неделю его послушали постоянные слушатели, и дальше он живёт строчкой в ленте. Через полгода вы сами не найдёте выпуск, где гость рассказывал, как нанимал первого редактора: расшифровки подкаста нет, а помните вы только, что дело было весной.
Текст закрывает то, чего звук не умеет в принципе: в аудио нельзя искать словом, из него нельзя скопировать абзац, его не пролистать глазами за три минуты. Отсюда пять задач, которые решает одна расшифровка.

- Поиск. В звуковом файле поисковику смотреть не на что. Страница с текстом — обычный документ: её находят по фразе, которую гость произнёс на сорок второй минуте.
- Доступность. Правила WCAG 2.1 требуют для предзаписанного аудио текстовой альтернативы — это критерий 1.2.1, самый базовый уровень A. Кроме тех, кто не слышит, текстом пользуются и те, кто не может включить звук.
- Переупаковка. Из одного разговора выходят статья, письмо подписчикам, карточки с цитатами и короткие видео — и всё это собирается по тексту.
- Навигация. Тайм-коды превращают час в оглавление: слушатель пришёл за одной темой и попал в неё сразу, а не возит ползунок наугад.
- Свой архив. Когда выпусков полсотни, поиск идёт по всем расшифровкам сразу: находится и фраза, и эпизод, где она прозвучала.
Шоуноты: описание, которое работает после выпуска
Шоуноты — описание эпизода, которое едет вместе с ним во все приложения. Работы у него две, и их путают: первые строки — анонс, всё остальное — справочник, куда возвращаются во время прослушивания и после.
В списке эпизодов видно только начало описания, дальше текст сворачивается. Поэтому первым идёт не «в этом выпуске мы поговорили о разном», а то, ради чего эпизод включают: какой вопрос разбирается и кто на него отвечает.
- Абзац о том, о чём выпуск. Два-три предложения от лица слушателя: какой вопрос разбирается и что он унесёт. Без «мы обсудили» — сразу тезис.
- Гость: имя, чем занимается, где найти. Имя и фамилию пишите так, как их пишет сам гость: по этому написанию выпуск и ищут.
- Тайм-коды по темам. Оглавление часа: время в начале строки, дальше — о чём этот кусок.
- Ссылки на всё, что прозвучало. Книги, исследования, сервисы, прошлый выпуск на ту же тему. Списком, каждая с новой строки.
- Две-три цитаты гостя. Дословные фразы работают лучше анонса, написанного своими словами.
- Ссылка на полный текст. Отдельной строкой: её открывают те, кто читает вместо прослушивания.
- Следующий шаг. Одна строка: где задать вопрос и что послушать дальше.
Описание размечается HTML, и набор тегов у площадок скромный. Spotify для авторов поддерживает ссылки (только https), заголовки первого и второго уровня, списки, абзацы и переносы строк — и предупреждает, что отдаёт вашу разметку остальным приложениям как есть. Вывод простой: ссылки списком, тайм-коды с новой строки, на сложную вёрстку не рассчитывать.
| Где живёт текст | Что там лежит | Объём | Кто это читает |
|---|---|---|---|
| Описание выпуска | анонс, гость, тайм-коды, ссылки | экран телефона | слушатель в приложении |
| Страница выпуска на сайте | полный текст по спикерам, оглавление, ссылки | весь разговор | поиск и те, кто читает вместо прослушивания |
| Файл транскрипта в RSS | текст с тайм-кодами, VTT или SRT | весь разговор | приложения, которые показывают транскрипт |
| Пост и письмо подписчикам | три тезиса и пара цитат | полэкрана | те, кто ещё не решил слушать |
Тайм-коды: как их ставить, чтобы они работали
Тайм-код — адрес фразы, и один список адресов работает сразу в трёх местах: в описании выпуска, в плеере как главы и внутри вашей работы, где по нему режут короткие видео и проверяют цитаты.
Главы площадки собирают из тайм-кодов в описании, но требования у всех разные, и при их нарушении отметки остаются просто текстом.
| Площадка | Откуда берутся главы | Минимум | Ограничения |
|---|---|---|---|
| YouTube | тайм-коды в описании ролика | три отметки по возрастанию | первая — 00:00, глава не короче 10 секунд |
| Spotify | тайм-коды в описании выпуска | три отметки | форматы ММ:СС и ЧЧ:ММ:СС, между началами глав не меньше 30 секунд |
| Apple Podcasts | тайм-коды в описании, тег глав в RSS или главы внутри самого файла | три главы | глава не короче двух минут, заголовок до 45 символов и меньше пяти слов |
Отсюда рабочее правило: список глав пишется один раз и по самым строгим требованиям из трёх — тогда он поедет везде без переделки. Начинайте с 00:00, ставьте не меньше трёх отметок, не дробите разговор чаще чем раз в две минуты и держите заголовок в сорока пяти символах.
- Заголовок главы — утверждение, а не ярлык. «Почему первый редактор ушёл через месяц» вместо «Часть 2». В сорок пять символов такая фраза укладывается, если убрать вводные слова.
- Первая отметка — знакомство. 00:00 «Кто сегодня в гостях» закрывает требование площадок и отвечает на первый вопрос слушателя.
- Режьте по темам, а не по структуре разговора. «Блок вопросов» — плохая глава, «Сколько стоит запись выпуска» — хорошая.
- Время ставьте по началу мысли, а не реплики. Гость обычно раскачивается полминуты; отметка нужна там, где начинается ответ по существу.
Гость, перебивания и живой диалог
Лекцию читает один человек, и текст получается ровный. Подкаст — разговор: ведущий поддакивает, гость договаривает мысль поверх следующего вопроса, оба смеются в одну секунду. Именно на этих местах расшифровка выглядит хуже, чем разговор звучал.
Это свойство материала, а не отдельного инструмента: Apple в справке для авторов прямо предупреждает, что фрагменты с наложением голосов и громкой музыкой распознаются труднее прочих. Таких мест за выпуск обычно десяток, и находятся они по тексту за пять минут.
- Стыки реплик. Конец фразы гостя мог уехать в реплику ведущего — правится переносом куска на нужную подпись.
- Два вопроса подряд. Если ведущий спрашивает дважды и ответа между ними нет, он склеился с чужой репликой.
- «Ага», «угу», «конечно». Их произносят поверх чужой речи, и в тексте они рвут абзац на куски. При вычитке такие вставки убирают.
- Имена и термины гостя. Названия компаний, фамилии, профессиональный жаргон: в часовом разговоре их редко больше двадцати, и все стоит проверить по записи.
- Смех и «секунду, я отвлекусь». В расшифровке для себя пусть остаются, в статью и цитаты не идут.
Половина этих хлопот снимается не расшифровкой, а записью. Три привычки экономят вечер вычитки: писать каждого своим микрофоном, держать паузу в полсекунды после вопроса и не поддакивать вслух — кивка достаточно. При раздельных дорожках спорное место слушают по дорожке одного человека, где чужой голос не мешает.
Как назвать спикеров
«Спикер 1» и «Спикер 2» — не подписи, а заглушки: такой диалог тяжело читать и невозможно искать. Имена ставят до того, как текст куда-то поедет, и это пятиминутная работа.
Реплики раскладывает по говорящим разделение спикеров, а имена подставляются из самого разговора: сказал ведущий «сегодня у нас Марина» — в тексте появится Марина, а не «Спикер 2». Дальше действуют простые правила.
- Имена, а не роли. «Ведущий» работает, пока ведущий один и выпуск один. В архиве из пятидесяти эпизодов это выглядит так, будто везде говорил один безымянный человек.
- Полное имя — один раз, в начале. «Марина Кутузова, шеф-редактор» в первой реплике, дальше по тексту — Марина. Читателю хватает, а поиск находит по фамилии.
- Фамилия пишется так, как её пишет сам гость. Проверьте по его сайту или соцсетям: разночтение в одной букве стоит вам всех переходов из поиска по имени.
- Одинаково во всех выпусках. «Аня» в одном эпизоде и «Анна Петрова» в другом — и поиск по архиву перестаёт собирать выпуски одного человека.
- Переименование — одно движение. Подпись меняется сразу по всей расшифровке, поэтому вычитку удобнее начинать именно с имён.
- В субтитрах имя привязывается к строке. Apple прямо пишет: файл VTT позволяет обозначить говорящего у каждой строки, и при смене голоса имя видно в транскрипте.

Как из расшифровки собрать статью
Час разговора — примерно восемь тысяч слов устной речи. Статья из них делается вычитанием: структуру уже задал ход беседы.
- Выкиньте служебное. Приветствие, «слышно ли меня», просьбу подписаться и рекламную вставку. Это минут шесть записи и полторы страницы текста.
- Превратите главы в подзаголовки. Оглавление, собранное для тайм-кодов, и есть план статьи — писать его заново не нужно.
- Вопрос ведущего разверните в первую фразу раздела. «А как вы искали первого редактора?» становится «Первого редактора искали через знакомых, и это была ошибка».
- Ответ сожмите, цитаты оставьте дословно. Сильную фразу гостя не пересказывают: она работает именно тем, как сказана.
- Уберите приметы устной речи. Повторы, «вот», «на самом деле», брошенные предложения. Смысл не трогайте: правка стиля — не правка позиции гостя.
- Допишите то, чего в разговоре не было. Ссылки на упомянутые книги, точные цифры вместо названных по памяти, справку о госте в начале.
- Оставьте тайм-код у каждого раздела. Читателю, которому важна интонация, он даёт вход в запись на нужной минуте.
В статью не переносят рекламные блоки, разговоры про технику записи и всё, что понятно только слушателям прошлого выпуска. Если структуру нужно вытащить до того, как садиться писать, порядок работы разобран отдельно — конспект из длинного видео. Формат, где доклад и вопросы зала разнесены по блокам, — расшифровка вебинара.
Десять цитат из одного выпуска
Сильные места в разговоре видно глазами лучше, чем на слух: в тексте сразу заметно, где мысль сказана коротко и целиком, а где её разбирали пять минут.
- Помещается в три строки и понятна без предыдущей реплики.
- Содержит утверждение, а не описание процесса: «мы год не могли нанять редактора» вместо «мы занимались наймом».
- Звучит как человек. Разговорную интонацию оставляйте — именно она отличает цитату от пресс-релиза.
- Не требует пояснять, кто это сказал. Имя и род занятий подписываются рядом, иначе цитата уезжает в ленту без автора.
У каждой цитаты есть тайм-код — и список фраз превращается в план нарезки: карточка собирается из текста, вертикальное видео режется по тому же времени, письмо подписчикам складывается из трёх тезисов и пары цитат. У эфиров во ВКонтакте цикл ровно такой же.
Подписи к вертикальным роликам — тот же текст, только нарезанный на короткие строки: субтитры к подкасту выгружаются в SRT и VTT, и их принимают и площадки, и монтажные программы.
Страница выпуска, которую находит поиск
У эпизода на сайте обычно живут плеер и три предложения описания. Это ровно та страница, которую поиск показывать не станет: смотреть ему не на что.
- Заголовок фразой, которую человек мог бы набрать в поиске, а не «Выпуск №47».
- Оглавление с тайм-кодами — ссылками на нужные места записи.
- Полный текст разговора по именам говорящих, разбитый подзаголовками из тех же глав.
- Ссылки, которые прозвучали, — тем, кто пришёл из поиска именно за ними.
- Короткое саммари сверху — для тех, кто выбирает: слушать целиком или прочитать за три минуты.
Для приложений, которые умеют показывать транскрипт, файл кладут в RSS отдельным тегом: открытое расширение RSS для подкастинга принимает текст, HTML, VTT, SRT и JSON, а у тега указывают язык файла. Apple из этого набора принимает VTT и SRT.
Саммари для верха страницы и заготовка шоунот — одна и та же выжимка: саммари подкаста собирается поверх расшифровки и даёт тезисы и темы, которые остаётся расставить по блокам описания.
- Выпускфайл записи
- Расшифровкаимена и тайм-коды
- Шоуноты и главыоглавление часа
- Материалыстатья, цитаты, страница
Расшифровка подкаста по шагам: от файла до шоунот
- Загрузите файл выпуска. Годится и монтажная дорожка, и видеоверсия: ограничения — до 4 ГБ и до 6 часов, часовой эпизод помещается с запасом.
- Получите текст. Реплики разложены по голосам, у каждой стоит время от начала выпуска.
- Подпишите спикеров. Имена — первым делом: дальше они разъедутся по шоунотам, статье и карточкам.
- Пройдите по стыкам реплик и по именам с терминами: клик по строке проигрывает именно её.
- Соберите оглавление. Темы с временем — они же главы для площадок, они же план статьи.
- Выгрузите нужное. DOCX для статьи, SRT и VTT для субтитров, Markdown или TXT для страницы выпуска.

Страница выпуска, файл транскрипта для RSS и субтитры к нарезкам — три разных файла из одного распознавания. Экспорт транскриптов отдаёт DOCX, PDF, TXT, Markdown, JSON, SRT и VTT, поэтому переделывать текст под каждый адрес не приходится.
Когда выпусков накопится десяток, поиск идёт по всему архиву — это заодно защита от повторов: перед записью видно, что ту же тему вы уже разбирали. Как это устроено для разговорных форматов — в сценарии интервью для подкаста.
Час записи — и шоуноты к вечеру
Загрузите выпуск: <a href="/podcast-transcription">расшифровка подкаста</a> вернёт текст с именами говорящих и тайм-кодами, а поверх него — тезисы для шоунот, цитаты и субтитры для нарезок.
Расшифровать выпускБесплатный старт без карты, файлы до 4 ГБ и до 6 часов. Выгрузка: DOCX, PDF, TXT, Markdown, JSON, SRT, VTT.
Частые вопросы
Зачем подкасту текстовая версия, если его всё равно слушают?
Ради трёх вещей. Поиск: страницу с текстом находят по фразе из разговора, звуковой файл — нет. Доступность: правила WCAG 2.1 требуют текстовой альтернативы к предзаписанному аудио на базовом уровне A. Переупаковка: статья, письмо, цитаты и нарезки собираются по тексту за вечер, а по записи — за неделю.
Как сделать расшифровку подкаста с ведущим и гостем?
Загрузить файл выпуска и получить текст, где реплики уже разложены по голосам, а у каждой стоит время от начала. Дальше подписи «Спикер 1» и «Спикер 2» меняются на имена — подпись заменяется сразу по всей расшифровке. Отдельно включать разделение говорящих не нужно, оно работает по умолчанию.
Что писать в шоунотах, чтобы их читали?
Абзац о том, о чём выпуск и кому он: его видно в списке эпизодов. Затем гость: имя, чем занимается, где его найти. Затем тайм-коды по темам и ссылки на всё, что прозвучало, — списком, каждая с новой строки. В конце — ссылка на полный текст и один следующий шаг.
Как правильно расставить тайм-коды для подкаста?
Время в начале строки, дальше название темы. YouTube требует первую отметку 00:00, не меньше трёх отметок по возрастанию и главу не короче 10 секунд. Spotify тоже просит минимум три отметки и не меньше 30 секунд между началами глав, принимая форматы ММ:СС и ЧЧ:ММ:СС. Apple советует главы для выпусков длиннее десяти минут: не короче двух минут каждая, заголовок до 45 символов. Пишите список по самым строгим требованиям — он подойдёт всем.
Что делать, если гость и ведущий перебивают друг друга?
Наложение речи — самое сложное место любой расшифровки, и Apple прямо предупреждает об этом авторов. Проверяют не весь час, а стыки: места, где реплика одного заканчивается внутри реплики другого. Признак склейки — два вопроса ведущего подряд без ответа между ними. Кусок находится по тайм-коду и переназначается на нужную подпись.
Как назвать спикеров в расшифровке выпуска?
Именами, а не ролями: «Ведущий» и «Гость» перестают работать со второго выпуска. Полное имя и род занятий — один раз в начале, дальше по имени. Фамилию пишите так, как её пишет сам гость, и одинаково во всех эпизодах, иначе поиск по архиву перестаёт собирать его выпуски вместе. Если имя прозвучало в разговоре, оно подставится в текст само.
Появится ли транскрипт выпуска в приложении подкастов?
Apple Podcasts делает транскрипты сам и принимает файлы от издателей через RSS в форматах VTT и SRT, но список языков там ограничен и русского в нём нет. Для русскоязычного шоу это значит, что текстовая версия живёт на вашей стороне: страницей выпуска, описанием и рассылкой. Файл транскрипта в RSS при этом положить всё равно можно — открытое расширение для подкастинга принимает текст, HTML, VTT, SRT и JSON.
Проверено 13 августа 2026: главы — по справкам YouTube «Video chapters», Spotify «Episode chapters» и «Formatting your show notes», Apple Podcasts «Chapters on Apple Podcasts»; транскрипты, форматы и языки — по «Transcripts on Apple Podcasts»; форматы файла транскрипта в RSS — по описанию тега transcript в открытом расширении RSS для подкастинга; текстовая альтернатива к предзаписанному аудио — WCAG 2.1, критерий 1.2.1 (уровень A).