Расшифровка подкаста: шоуноты, тайм-коды и текст, который ищется

ГАЙД

Расшифровка подкаста: шоуноты, тайм-коды и текст, который ищется

Час разговора живёт неделю в ленте, а потом теряется даже для вас. Как получить текст выпуска со спикерами и тайм-кодами и собрать из него шоуноты, статью и цитаты.

Выпуск вышел — и на этом всё

Эпизод выложили в понедельник, за неделю его послушали постоянные слушатели, и дальше он живёт строчкой в ленте. Через полгода вы сами не найдёте выпуск, где гость рассказывал, как нанимал первого редактора: расшифровки подкаста нет, а помните вы только, что дело было весной.

Текст закрывает то, чего звук не умеет в принципе: в аудио нельзя искать словом, из него нельзя скопировать абзац, его не пролистать глазами за три минуты. Отсюда пять задач, которые решает одна расшифровка.

Текст выпуска подкаста: реплики говорящих с тайм-кодом у каждой строки
В звуковом файле искать нечего. В тексте у каждой фразы есть адрес — по нему потом собираются и главы, и цитаты, и нарезки.
  • Поиск. В звуковом файле поисковику смотреть не на что. Страница с текстом — обычный документ: её находят по фразе, которую гость произнёс на сорок второй минуте.
  • Доступность. Правила WCAG 2.1 требуют для предзаписанного аудио текстовой альтернативы — это критерий 1.2.1, самый базовый уровень A. Кроме тех, кто не слышит, текстом пользуются и те, кто не может включить звук.
  • Переупаковка. Из одного разговора выходят статья, письмо подписчикам, карточки с цитатами и короткие видео — и всё это собирается по тексту.
  • Навигация. Тайм-коды превращают час в оглавление: слушатель пришёл за одной темой и попал в неё сразу, а не возит ползунок наугад.
  • Свой архив. Когда выпусков полсотни, поиск идёт по всем расшифровкам сразу: находится и фраза, и эпизод, где она прозвучала.
Четыре материала растут из одного разбора: общий у них тайм-код, поэтому текст правится один раз, а меняется только упаковка.

Шоуноты: описание, которое работает после выпуска

Шоуноты — описание эпизода, которое едет вместе с ним во все приложения. Работы у него две, и их путают: первые строки — анонс, всё остальное — справочник, куда возвращаются во время прослушивания и после.

В списке эпизодов видно только начало описания, дальше текст сворачивается. Поэтому первым идёт не «в этом выпуске мы поговорили о разном», а то, ради чего эпизод включают: какой вопрос разбирается и кто на него отвечает.

Порядок блоков задаётся тем, как описание читают: сверху вниз и до первого экрана. Тайм-коды и ссылки работают только строками, а не внутри абзаца.
  1. Абзац о том, о чём выпуск. Два-три предложения от лица слушателя: какой вопрос разбирается и что он унесёт. Без «мы обсудили» — сразу тезис.
  2. Гость: имя, чем занимается, где найти. Имя и фамилию пишите так, как их пишет сам гость: по этому написанию выпуск и ищут.
  3. Тайм-коды по темам. Оглавление часа: время в начале строки, дальше — о чём этот кусок.
  4. Ссылки на всё, что прозвучало. Книги, исследования, сервисы, прошлый выпуск на ту же тему. Списком, каждая с новой строки.
  5. Две-три цитаты гостя. Дословные фразы работают лучше анонса, написанного своими словами.
  6. Ссылка на полный текст. Отдельной строкой: её открывают те, кто читает вместо прослушивания.
  7. Следующий шаг. Одна строка: где задать вопрос и что послушать дальше.

Описание размечается HTML, и набор тегов у площадок скромный. Spotify для авторов поддерживает ссылки (только https), заголовки первого и второго уровня, списки, абзацы и переносы строк — и предупреждает, что отдаёт вашу разметку остальным приложениям как есть. Вывод простой: ссылки списком, тайм-коды с новой строки, на сложную вёрстку не рассчитывать.

Где живёт текстЧто там лежитОбъёмКто это читает
Описание выпускаанонс, гость, тайм-коды, ссылкиэкран телефонаслушатель в приложении
Страница выпуска на сайтеполный текст по спикерам, оглавление, ссылкивесь разговорпоиск и те, кто читает вместо прослушивания
Файл транскрипта в RSSтекст с тайм-кодами, VTT или SRTвесь разговорприложения, которые показывают транскрипт
Пост и письмо подписчикамтри тезиса и пара цитатполэкранате, кто ещё не решил слушать

Тайм-коды: как их ставить, чтобы они работали

Тайм-код — адрес фразы, и один список адресов работает сразу в трёх местах: в описании выпуска, в плеере как главы и внутри вашей работы, где по нему режут короткие видео и проверяют цитаты.

Главы площадки собирают из тайм-кодов в описании, но требования у всех разные, и при их нарушении отметки остаются просто текстом.

ПлощадкаОткуда берутся главыМинимумОграничения
YouTubeтайм-коды в описании роликатри отметки по возрастаниюпервая — 00:00, глава не короче 10 секунд
Spotifyтайм-коды в описании выпускатри отметкиформаты ММ:СС и ЧЧ:ММ:СС, между началами глав не меньше 30 секунд
Apple Podcastsтайм-коды в описании, тег глав в RSS или главы внутри самого файлатри главыглава не короче двух минут, заголовок до 45 символов и меньше пяти слов

Отсюда рабочее правило: список глав пишется один раз и по самым строгим требованиям из трёх — тогда он поедет везде без переделки. Начинайте с 00:00, ставьте не меньше трёх отметок, не дробите разговор чаще чем раз в две минуты и держите заголовок в сорока пяти символах.

  • Заголовок главы — утверждение, а не ярлык. «Почему первый редактор ушёл через месяц» вместо «Часть 2». В сорок пять символов такая фраза укладывается, если убрать вводные слова.
  • Первая отметка — знакомство. 00:00 «Кто сегодня в гостях» закрывает требование площадок и отвечает на первый вопрос слушателя.
  • Режьте по темам, а не по структуре разговора. «Блок вопросов» — плохая глава, «Сколько стоит запись выпуска» — хорошая.
  • Время ставьте по началу мысли, а не реплики. Гость обычно раскачивается полминуты; отметка нужна там, где начинается ответ по существу.

Гость, перебивания и живой диалог

Лекцию читает один человек, и текст получается ровный. Подкаст — разговор: ведущий поддакивает, гость договаривает мысль поверх следующего вопроса, оба смеются в одну секунду. Именно на этих местах расшифровка выглядит хуже, чем разговор звучал.

Это свойство материала, а не отдельного инструмента: Apple в справке для авторов прямо предупреждает, что фрагменты с наложением голосов и громкой музыкой распознаются труднее прочих. Таких мест за выпуск обычно десяток, и находятся они по тексту за пять минут.

Проверять весь час не нужно: ошибки в диалоге кучкуются там, где дорожки накладываются, — на стыках вопроса и ответа.
  • Стыки реплик. Конец фразы гостя мог уехать в реплику ведущего — правится переносом куска на нужную подпись.
  • Два вопроса подряд. Если ведущий спрашивает дважды и ответа между ними нет, он склеился с чужой репликой.
  • «Ага», «угу», «конечно». Их произносят поверх чужой речи, и в тексте они рвут абзац на куски. При вычитке такие вставки убирают.
  • Имена и термины гостя. Названия компаний, фамилии, профессиональный жаргон: в часовом разговоре их редко больше двадцати, и все стоит проверить по записи.
  • Смех и «секунду, я отвлекусь». В расшифровке для себя пусть остаются, в статью и цитаты не идут.

Половина этих хлопот снимается не расшифровкой, а записью. Три привычки экономят вечер вычитки: писать каждого своим микрофоном, держать паузу в полсекунды после вопроса и не поддакивать вслух — кивка достаточно. При раздельных дорожках спорное место слушают по дорожке одного человека, где чужой голос не мешает.

Это не про технику, а про вечер вашего времени: три привычки на записи убирают большую часть будущей правки текста.

Как назвать спикеров

«Спикер 1» и «Спикер 2» — не подписи, а заглушки: такой диалог тяжело читать и невозможно искать. Имена ставят до того, как текст куда-то поедет, и это пятиминутная работа.

Реплики раскладывает по говорящим разделение спикеров, а имена подставляются из самого разговора: сказал ведущий «сегодня у нас Марина» — в тексте появится Марина, а не «Спикер 2». Дальше действуют простые правила.

  1. Имена, а не роли. «Ведущий» работает, пока ведущий один и выпуск один. В архиве из пятидесяти эпизодов это выглядит так, будто везде говорил один безымянный человек.
  2. Полное имя — один раз, в начале. «Марина Кутузова, шеф-редактор» в первой реплике, дальше по тексту — Марина. Читателю хватает, а поиск находит по фамилии.
  3. Фамилия пишется так, как её пишет сам гость. Проверьте по его сайту или соцсетям: разночтение в одной букве стоит вам всех переходов из поиска по имени.
  4. Одинаково во всех выпусках. «Аня» в одном эпизоде и «Анна Петрова» в другом — и поиск по архиву перестаёт собирать выпуски одного человека.
  5. Переименование — одно движение. Подпись меняется сразу по всей расшифровке, поэтому вычитку удобнее начинать именно с имён.
  6. В субтитрах имя привязывается к строке. Apple прямо пишет: файл VTT позволяет обозначить говорящего у каждой строки, и при смене голоса имя видно в транскрипте.
Карточки участников выпуска с числом реплик и кнопкой распознать имена
Имена подписывают в первую очередь: дальше они разъедутся по шоунотам, цитатам и странице выпуска. В архиве из пятидесяти эпизодов «Ведущий» не говорит ничего.

Как из расшифровки собрать статью

Час разговора — примерно восемь тысяч слов устной речи. Статья из них делается вычитанием: структуру уже задал ход беседы.

  1. Выкиньте служебное. Приветствие, «слышно ли меня», просьбу подписаться и рекламную вставку. Это минут шесть записи и полторы страницы текста.
  2. Превратите главы в подзаголовки. Оглавление, собранное для тайм-кодов, и есть план статьи — писать его заново не нужно.
  3. Вопрос ведущего разверните в первую фразу раздела. «А как вы искали первого редактора?» становится «Первого редактора искали через знакомых, и это была ошибка».
  4. Ответ сожмите, цитаты оставьте дословно. Сильную фразу гостя не пересказывают: она работает именно тем, как сказана.
  5. Уберите приметы устной речи. Повторы, «вот», «на самом деле», брошенные предложения. Смысл не трогайте: правка стиля — не правка позиции гостя.
  6. Допишите то, чего в разговоре не было. Ссылки на упомянутые книги, точные цифры вместо названных по памяти, справку о госте в начале.
  7. Оставьте тайм-код у каждого раздела. Читателю, которому важна интонация, он даёт вход в запись на нужной минуте.

В статью не переносят рекламные блоки, разговоры про технику записи и всё, что понятно только слушателям прошлого выпуска. Если структуру нужно вытащить до того, как садиться писать, порядок работы разобран отдельно — конспект из длинного видео. Формат, где доклад и вопросы зала разнесены по блокам, — расшифровка вебинара.

Десять цитат из одного выпуска

Сильные места в разговоре видно глазами лучше, чем на слух: в тексте сразу заметно, где мысль сказана коротко и целиком, а где её разбирали пять минут.

  • Помещается в три строки и понятна без предыдущей реплики.
  • Содержит утверждение, а не описание процесса: «мы год не могли нанять редактора» вместо «мы занимались наймом».
  • Звучит как человек. Разговорную интонацию оставляйте — именно она отличает цитату от пресс-релиза.
  • Не требует пояснять, кто это сказал. Имя и род занятий подписываются рядом, иначе цитата уезжает в ленту без автора.

У каждой цитаты есть тайм-код — и список фраз превращается в план нарезки: карточка собирается из текста, вертикальное видео режется по тому же времени, письмо подписчикам складывается из трёх тезисов и пары цитат. У эфиров во ВКонтакте цикл ровно такой же.

Карточка с цитатойФраза, имя гостя, обложка выпуска. Делается из текста за минуту, ссылка ведёт на эпизод.
Короткое видеоТайм-код у цитаты — точка входа: фрагмент режется по времени, а подписи к нему берутся из той же расшифровки.
Письмо и постТри тезиса, две цитаты, оглавление с тайм-кодами. Собирается за двадцать минут, а не за вечер.

Подписи к вертикальным роликам — тот же текст, только нарезанный на короткие строки: субтитры к подкасту выгружаются в SRT и VTT, и их принимают и площадки, и монтажные программы.

Страница выпуска, которую находит поиск

У эпизода на сайте обычно живут плеер и три предложения описания. Это ровно та страница, которую поиск показывать не станет: смотреть ему не на что.

  • Заголовок фразой, которую человек мог бы набрать в поиске, а не «Выпуск №47».
  • Оглавление с тайм-кодами — ссылками на нужные места записи.
  • Полный текст разговора по именам говорящих, разбитый подзаголовками из тех же глав.
  • Ссылки, которые прозвучали, — тем, кто пришёл из поиска именно за ними.
  • Короткое саммари сверху — для тех, кто выбирает: слушать целиком или прочитать за три минуты.

Для приложений, которые умеют показывать транскрипт, файл кладут в RSS отдельным тегом: открытое расширение RSS для подкастинга принимает текст, HTML, VTT, SRT и JSON, а у тега указывают язык файла. Apple из этого набора принимает VTT и SRT.

Саммари для верха страницы и заготовка шоунот — одна и та же выжимка: саммари подкаста собирается поверх расшифровки и даёт тезисы и темы, которые остаётся расставить по блокам описания.

  1. Выпускфайл записи
  2. Расшифровкаимена и тайм-коды
  3. Шоуноты и главыоглавление часа
  4. Материалыстатья, цитаты, страница

Расшифровка подкаста по шагам: от файла до шоунот

  1. Загрузите файл выпуска. Годится и монтажная дорожка, и видеоверсия: ограничения — до 4 ГБ и до 6 часов, часовой эпизод помещается с запасом.
  2. Получите текст. Реплики разложены по голосам, у каждой стоит время от начала выпуска.
  3. Подпишите спикеров. Имена — первым делом: дальше они разъедутся по шоунотам, статье и карточкам.
  4. Пройдите по стыкам реплик и по именам с терминами: клик по строке проигрывает именно её.
  5. Соберите оглавление. Темы с временем — они же главы для площадок, они же план статьи.
  6. Выгрузите нужное. DOCX для статьи, SRT и VTT для субтитров, Markdown или TXT для страницы выпуска.
Автоматические разделы выпуска с временем начала — заготовка тайм-кодов для шоунот
Тайм-коды для описания собираются сами: раздел, его время и строка о содержании. Остаётся привести формулировки к своему тону.

Страница выпуска, файл транскрипта для RSS и субтитры к нарезкам — три разных файла из одного распознавания. Экспорт транскриптов отдаёт DOCX, PDF, TXT, Markdown, JSON, SRT и VTT, поэтому переделывать текст под каждый адрес не приходится.

Когда выпусков накопится десяток, поиск идёт по всему архиву — это заодно защита от повторов: перед записью видно, что ту же тему вы уже разбирали. Как это устроено для разговорных форматов — в сценарии интервью для подкаста.

Час записи — и шоуноты к вечеру

Загрузите выпуск: <a href="/podcast-transcription">расшифровка подкаста</a> вернёт текст с именами говорящих и тайм-кодами, а поверх него — тезисы для шоунот, цитаты и субтитры для нарезок.

Расшифровать выпуск

Бесплатный старт без карты, файлы до 4 ГБ и до 6 часов. Выгрузка: DOCX, PDF, TXT, Markdown, JSON, SRT, VTT.

Частые вопросы

Зачем подкасту текстовая версия, если его всё равно слушают?

Ради трёх вещей. Поиск: страницу с текстом находят по фразе из разговора, звуковой файл — нет. Доступность: правила WCAG 2.1 требуют текстовой альтернативы к предзаписанному аудио на базовом уровне A. Переупаковка: статья, письмо, цитаты и нарезки собираются по тексту за вечер, а по записи — за неделю.

Как сделать расшифровку подкаста с ведущим и гостем?

Загрузить файл выпуска и получить текст, где реплики уже разложены по голосам, а у каждой стоит время от начала. Дальше подписи «Спикер 1» и «Спикер 2» меняются на имена — подпись заменяется сразу по всей расшифровке. Отдельно включать разделение говорящих не нужно, оно работает по умолчанию.

Что писать в шоунотах, чтобы их читали?

Абзац о том, о чём выпуск и кому он: его видно в списке эпизодов. Затем гость: имя, чем занимается, где его найти. Затем тайм-коды по темам и ссылки на всё, что прозвучало, — списком, каждая с новой строки. В конце — ссылка на полный текст и один следующий шаг.

Как правильно расставить тайм-коды для подкаста?

Время в начале строки, дальше название темы. YouTube требует первую отметку 00:00, не меньше трёх отметок по возрастанию и главу не короче 10 секунд. Spotify тоже просит минимум три отметки и не меньше 30 секунд между началами глав, принимая форматы ММ:СС и ЧЧ:ММ:СС. Apple советует главы для выпусков длиннее десяти минут: не короче двух минут каждая, заголовок до 45 символов. Пишите список по самым строгим требованиям — он подойдёт всем.

Что делать, если гость и ведущий перебивают друг друга?

Наложение речи — самое сложное место любой расшифровки, и Apple прямо предупреждает об этом авторов. Проверяют не весь час, а стыки: места, где реплика одного заканчивается внутри реплики другого. Признак склейки — два вопроса ведущего подряд без ответа между ними. Кусок находится по тайм-коду и переназначается на нужную подпись.

Как назвать спикеров в расшифровке выпуска?

Именами, а не ролями: «Ведущий» и «Гость» перестают работать со второго выпуска. Полное имя и род занятий — один раз в начале, дальше по имени. Фамилию пишите так, как её пишет сам гость, и одинаково во всех эпизодах, иначе поиск по архиву перестаёт собирать его выпуски вместе. Если имя прозвучало в разговоре, оно подставится в текст само.

Появится ли транскрипт выпуска в приложении подкастов?

Apple Podcasts делает транскрипты сам и принимает файлы от издателей через RSS в форматах VTT и SRT, но список языков там ограничен и русского в нём нет. Для русскоязычного шоу это значит, что текстовая версия живёт на вашей стороне: страницей выпуска, описанием и рассылкой. Файл транскрипта в RSS при этом положить всё равно можно — открытое расширение для подкастинга принимает текст, HTML, VTT, SRT и JSON.

Проверено 13 августа 2026: главы — по справкам YouTube «Video chapters», Spotify «Episode chapters» и «Formatting your show notes», Apple Podcasts «Chapters on Apple Podcasts»; транскрипты, форматы и языки — по «Transcripts on Apple Podcasts»; форматы файла транскрипта в RSS — по описанию тега transcript в открытом расширении RSS для подкастинга; текстовая альтернатива к предзаписанному аудио — WCAG 2.1, критерий 1.2.1 (уровень A).