Перевод аудиозаписи на русский: почему сначала делают расшифровку

ГАЙД

Перевод аудиозаписи на русский: почему сначала делают расшифровку

Переводчику присылают не текст, а файл: интервью, переговоры, видео, запись заседания. Как разложить запись до начала перевода, как посчитать объём работы в минутах и знаках и как оформить двуязычный документ и субтитры.

Перевод аудиозаписи на русский начинается не с перевода

Заказчик присылает не документ, а файл: полтора часа переговоров, интервью с экспертом, видео с конференции, запись заседания. Перевод аудиозаписи на русский в такой постановке — это две работы, а не одна, и первая из них к переводу отношения не имеет: запись сначала надо разложить на текст, реплики и время. Дальше — про то, как эта первая часть устроена и почему её пропуск стоит дороже, чем она сама.

Разница не в скорости, а в том, остаётся ли после работы предмет для проверки. В верхнем маршруте ошибка распознанного на слух слова уже упакована в гладкую русскую фразу.

Оговорка, которая экономит время всем: слово «перевод» в русском рабочем обиходе означает две разные вещи. «Перевести запись в текст» — это расшифровка, тот же смысл, что «перевести деньги на счёт»; отсюда и запрос перевод аудио в текст с таймкодами, за которым стоит транскрибация, а не работа с иностранным языком. Прежде чем считать смету, стоит выяснить у заказчика, какое из двух значений он имел в виду: это две разные услуги с разной ценой.

Почему работа с голоса дороже, а не быстрее

Соблазн понятный: зачем набирать оригинал, если можно слушать и сразу писать по-русски. На коротком фрагменте это правда работает. На полутора часах переговоров ломается сразу в нескольких местах.

  • Объём неизвестен до конца работы. Пока текста нет, вы не знаете, сколько в записи знаков: полтора часа доклада и полтора часа переговоров с паузами отличаются по объёму в разы. Смета «за минуту» перекладывает этот риск на кого-то одного, и обычно не на заказчика.
  • Нельзя искать. Термин, который встретился на сороковой минуте, надо согласовать с тем, как вы перевели его на восьмой. По тексту это поиск, по записи — перемотка.
  • Ничего не ложится в память переводов. Пары «сегмент оригинала — сегмент перевода» не возникает, и следующая запись того же заказчика начинается с нуля.
  • Редактор не может проверить работу. Ему нечего сопоставлять: чтобы оценить перевод, придётся слушать те же полтора часа. На практике это означает, что проверки не будет.
  • Правка стоит как повторное прослушивание. Замечание «на 47-й минуте не тот термин» без текста превращается в поиск по звуку.
  • Спорное место негде обозначить. В тексте неразборчивый кусок помечается и обсуждается с заказчиком. В переводе с голоса он либо угадан, либо потерян, и заметить это некому.
Плеер под расшифровкой записи: спорная реплика открывается из строки текста, без перемотки файла
Вся экономия второго маршрута держится на этой связке: сомнительное место найдено глазами в тексте, а слушается ровно тот кусок, где оно прозвучало.

Как считать объём: минуты записи против знаков текста

Главный источник убытков в таких заказах — единица измерения. Заказчик мыслит минутами, потому что у него на руках файл. Переводчик живёт в знаках, потому что от них зависит время работы. Связь между ними не постоянная: она зависит от темпа, пауз, количества говорящих и жанра записи.

ЕдиницаЧто измеряетКогда годитсяГде подводит
Минута записиДлину файлаРасшифровка, субтитры, таймингМолчание и паузы оплачиваются так же, как плотная речь
Условная страница, 1800 знаковОбъём готового текстаПеревод и редактураДо расшифровки объём неизвестен
СловоОбъём текста в англоязычной практикеРабота с зарубежным заказчикомРусский и английский счёт слов не совпадают между собой
Час работыЗатраченное времяВычитка, сверка терминов, оформлениеТребует доверия и учёта, а не только договорённости

Отсюда рабочая схема расчёта, которая не требует ни от кого верить на слово: объём считается по своей же записи, а не по средним цифрам из интернета.

  1. Расшифруйте 10 минут файла. Не первые десять — начало почти всегда разреженное: приветствия, проверка связи, представления.
  2. Посмотрите объём в знаках с пробелами. Текстовый редактор считает это одной командой; служебные подписи говорящих и таймкоды из подсчёта исключите.
  3. Переведите в страницы. Разделите на 1800 — получится, сколько условных страниц даёт десять минут именно этой записи.
  4. Умножьте на длину файла. Допустим, 10 минут дали 8400 знаков — это 4,7 страницы, а запись на 90 минут даёт около 42 страниц. С такой цифрой уже можно называть срок.
  5. Заложите отдельной строкой расшифровку и вычитку. Это работа до перевода, и она либо оплачивается, либо съедает маржу перевода.
  6. Проверьте коэффициент на втором заказе того же типа. У переговоров, лекции и телефонного разговора он разный и довольно устойчивый внутри жанра.
Средних коэффициентов «минута = столько-то знаков» не бывает: у доклада, переговоров и телефонного разговора они разные. Свой считается один раз на десяти минутах и дальше работает.

Что сделать с расшифровкой до того, как начнётся перевод

Сырая расшифровка — ещё не рабочий материал. Между «текст получен» и «можно переводить» лежат несколько операций, каждая из которых занимает минуты и экономит часы.

  1. Разложите реплики по говорящим и назовите роли. Не фамилии, а роли: «Интервьюер», «Эксперт», «Сторона А». В переводе от роли зависят и обращение, и регистр, и выбор «вы» или «ты».
  2. Проверьте, что у каждой реплики есть таймкод. Это единственный способ вернуться к спорному месту, не переслушивая файл, и единственный якорь для замечаний заказчика.
  3. Пройдите по именам, названиям и цифрам. Распознавание пишет незнакомое слово так, как услышало; ошибка здесь тихая — текст выглядит осмысленным.
  4. Соберите глоссарий до перевода, а не по ходу. Двадцать терминов, выписанных заранее, снимают половину правок редактора и всю разноголосицу внутри документа.
  5. Отметьте всё, что не разобрали. С таймкодом и без догадок — об этом отдельный раздел ниже.
  6. Согласуйте с заказчиком спорные места одним письмом. Список из десяти пунктов в начале работы дешевле десяти уточнений по ходу.
Расшифровка записи на языке оригинала: реплики по говорящим, у каждой отметка времени
Вот исходник, с которого начинается перевод: кто говорит, что именно и на какой минуте. По такому тексту работают поиском и правкой, а не перемоткой.

Термины, диалекты и то, что записано на слух

Устная речь отличается от письменного источника не только неполными предложениями. В ней есть слои, которых в документе не бывает, и каждый требует отдельного решения переводчика — до того, как он начнёт писать.

  • Региональные варианты и диалектизмы. Решение принимается один раз на весь документ: передавать ли просторечие просторечием, или снимать окраску и оставлять смысл. Записывается в шапку файла, чтобы редактор не считал это ошибкой.
  • Профессиональный жаргон. В речи он всегда плотнее, чем в документах той же отрасли: люди говорят сокращениями, которые вслух понятны, а на письме требуют расшифровки. Уточняется у заказчика вместе с глоссарием.
  • Внутренние аббревиатуры и названия продуктов. Именно здесь распознавание ошибается чаще всего, и именно здесь ошибку труднее заметить в переводе.
  • Смешанная речь. Вставки на другом языке внутри фразы — обычное дело в рабочих разговорах. Их отмечают в оригинале, а в переводе решают отдельно: сохранить, перевести или дать оба варианта.
  • Числа, даты и суммы. Устная форма многозначна, а цена ошибки максимальная. Каждое такое место сверяется по звуку, а не по контексту.
  • Оговорки и самопоправки. «Пятнадцатого… нет, шестнадцатого» — в дословном тексте остаются обе, в чистовом переводе только вторая. Что именно нужно заказчику, спрашивают заранее.

Отдельная тема — от чего вообще зависит качество исходного текста: акцент, темп, канал записи и переключение языков внутри одной дорожки разобраны в статье расшифровка аудио на иностранном языке. Для переводчика вывод оттуда практический: чем хуже звук, тем длиннее будет список мест, которые придётся согласовывать с заказчиком, и это оценивается до начала работы.

«Неразборчиво» — это профессиональная норма, а не брак

Начинающий исполнитель прячет непонятое место: подставляет правдоподобное слово и идёт дальше. Опытный помечает. Разница видна не в момент сдачи, а через месяц, когда выясняется, что в правдоподобном слове был весь смысл абзаца.

Пометка — единственный из трёх исходов, который заканчивается ответом. Два других заканчиваются тем, что кто-то узнаёт о проблеме позже вас.

Как это оформляют, чтобы пометка читалась одинаково всеми:

  • Единое обозначение на весь документ. «[неразборчиво]» или «[нрзб.]» — важно не какое, а чтобы одно; список условных обозначений выносится в шапку.
  • Длительность у длинных провалов. «[неразборчиво, 6 с]» говорит заказчику, потерян ли оборот или потерян абзац.
  • Таймкод рядом. Пометка без времени бесполезна: проверить её нельзя, а значит, и снять вопрос нельзя.
  • Неречевые события — тоже в скобках. «[говорят одновременно]», «[пауза]», «[смех]» объясняют, почему кусок не разобран, и снимают подозрение в невнимательности.
  • Предположение помечается как предположение. Если слово почти разобрано, пишут «[предположительно: аллокация]», а не «аллокация».
  • Список пометок выносится сопроводительным письмом. Десять строк с временем — и заказчик, который был на встрече, закрывает половину за пять минут.

Как оформить двуязычный документ

Заказчику почти всегда нужен не перевод вместо оригинала, а оба текста рядом: он хочет видеть, откуда взялась формулировка. Раскладок три, и выбор между ними определяется не вкусом, а тем, что человек будет с документом делать.

РаскладкаКому удобнаЧем неудобна
Две колонки: оригинал слева, перевод справаТому, кто сверяет построчно: юристу, редактору, заказчику со знанием языкаЛомается при печати и на телефоне, длинные реплики разъезжаются
Чередование: реплика оригинала, под ней переводТому, кто читает подряд и иногда заглядывает в оригиналДокумент вдвое длиннее, читать сплошняком тяжело
Два отдельных файла с общей нумерацией сегментовТому, кто работает с текстом дальше: монтаж, цитаты, публикацияТребует дисциплины: нумерация должна совпадать до конца
  1. Пронумеруйте сегменты в оригинале до перевода. Номер — единственная связь между двумя текстами, которая переживёт любое переформатирование.
  2. Таймкоды оставьте только в оригинале. Дублировать их в переводе незачем: время относится к записи, а не к языку.
  3. Сделайте шапку одинаковой в обоих файлах. Что за запись, длительность, кто говорит, какие условные обозначения приняты, дата работы.
  4. Пометки переносите в перевод как есть. «[неразборчиво, 6 с]» должно стоять в обоих текстах в одном и том же сегменте, иначе документы разъедутся.
  5. Комментарий переводчика — отдельным слоем. Сноска или колонка примечаний, но не текст внутри реплики: смешанные слои через месяц не разделяются.
  6. Отдавайте в редактируемом формате. DOCX для документа, TXT или Markdown — если текст пойдёт в дальнейшую обработку.
Окно выгрузки расшифровки: DOCX, PDF, обычный текст, SRT, VTT, JSON и Markdown
Формат выгрузки выбирают под то, что будет дальше: DOCX — под двуязычный документ, SRT и VTT — под субтитры, TXT и Markdown — если текст уходит в кошку или в шаблон.

Субтитры на втором языке: что нельзя трогать и во что надо уложиться

Если заказчику нужны не документ, а субтитры, работа меняется сильнее, чем кажется. Перевод для субтитров — не перевод текста, а перевод в рамку: у каждой реплики есть окно по времени, и текст обязан в него поместиться.

Первое правило механическое. В файле SRT переводят только текстовые строки, не трогая ни номера блоков, ни строки тайминга вида 00:01:12,340 --> 00:01:15,880. Тайминг снят с оригинальной записи и уже выверен по звуку; если отдать файл целиком в автоматический перевод, форматирование тайминг-строк обычно ломается, и плеер такой файл не открывает.

Второе правило — про ограничения, которые в текстовом переводе не встречаются. Ориентиром служат опубликованные требования вещателей; у Netflix русское руководство по таймированному тексту задаёт их прямо:

  • 42 знака в строке и не больше двух строк в одном субтитре.
  • Скорость чтения — до 17 знаков в секунду для взрослой аудитории и до 13 для детской; для субтитров с описанием звуков пределы выше — 20 и 17.
  • Минимальная длительность события — 20 кадров: при 25 кадрах в секунду это 0,8 секунды.
  • Минимальный зазор между соседними субтитрами — 2 кадра; промежутки от 3 до 11 кадров сводят к двум кадрам либо растягивают до 0,5 секунды.

Из этих чисел следует то, что обычно обнаруживают уже в процессе: первым упирается не лимит строки, а скорость чтения. Реплика длиной 2 секунды при пределе 17 знаков в секунду вмещает около 34 знаков — то есть меньше одной полной строки, хотя формально разрешено две по 42. А русский перевод английской фразы почти всегда длиннее оригинала.

Выход один и он же профессиональный: сокращать формулировку, а не уменьшать шрифт и не растягивать событие на соседнюю реплику. Смысл сохраняется, слова — нет.

Что просить у заказчика вместе с записью

Половина проблем с такими заказами решается тремя вопросами, заданными до начала работы. Задавать их неудобно ровно один раз.

Оригинал файла, а не пересланныйЗапись, прошедшая через мессенджер, ужата ещё раз поверх исходного сжатия. На разборчивости это сказывается сильнее, чем любой акцент.
Кто говорит и кем работаетСписок участников с ролями и хотя бы приблизительной темой встречи. Без него имена и термины разбираются вслепую.
Куда пойдёт текстДокумент, субтитры, публикация, внутренний разбор. От ответа зависят и дословность, и формат, и цена.
  • Глоссарий или прошлые материалы. Даже кривая табличка терминов от заказчика лучше, чем ваши догадки о том, как у них принято.
  • Написание имён. Фамилии участников в письменном виде — минута работы заказчика и полчаса вашей.
  • Что делать с оговорками и словами-паразитами. Дословный текст и причёсанный — разные документы, и решает это заказчик, а не исполнитель.
  • Срок и форма приёмки. Кто вычитывает результат и по какому критерию: без ответа приёмка превращается в переписку.
Письмо заказчику в ответ на присланный файл
Файл получил, длительность ___ , предварительно берусь. Чтобы назвать срок и сумму, уточню шесть вещей.
1. Что нужно на выходе: двуязычный документ, только перевод или субтитры? От этого зависят и формат, и цена.
2. Текст дословный или причёсанный — с оговорками и повторами или без них?
3. Кто говорит: список участников с ролями и написанием фамилий.
4. Тема и глоссарий: термины, названия продуктов, внутренние сокращения — даже черновой табличкой.
5. Есть ли оригинал файла, не пересланный через мессенджер? Пересжатие бьёт по разборчивости сильнее акцента.
6. Кто принимает работу и по какому критерию, срок сдачи: ___
Порядок работы: сначала расшифровка на языке записи с таймкодами и пометками [неразборчиво], затем перевод по выверенному тексту. Объём в страницах назову после первых 10 минут расшифровки — по ним считается коэффициент именно этой записи.
Смета будет из двух строк: расшифровка — по минутам записи, перевод — по страницам 1800 знаков.

Шесть вопросов, заданных до начала, заменяют десять уточнений по ходу и снимают спор о цене на приёмке.

Маршрут целиком

Если собрать всё вместе, работа выглядит так — и первые два шага занимают меньше времени, чем кажется, а экономят больше всего.

  1. Текст оригиналаговорящие, таймкоды, пометки
  2. Вычитка и глоссарийимена, термины, цифры
  3. Переводпо выверенному тексту, а не с голоса
  4. Сдачадвуязычный документ или субтитры

Про первый шаг стоит сказать прямо, чтобы не было недоразумений: сервис отдаёт текст на языке оригинала, а не перевод. Он раскладывает запись по говорящим, ставит время у каждой реплики и позволяет прослушать любую строку из текста; перевод дальше делаете вы — руками, кошкой или языковой моделью, по выверенному оригиналу. Рабочие языки — русский и английский; как обрабатывается запись не на родном языке, показано на странице многоязычная расшифровка аудио и видео, а англоязычный материал — на странице английская речь в текст.

Панель говорящих в записи переговоров: реплики каждого участника собраны отдельно, подписи переименовываются в роли
Второй шаг начинается здесь: участники разводятся автоматически, а нейтральные подписи вы меняете на роли — «Интервьюер», «Эксперт», «Сторона А».

И последнее, что стоит держать в голове при разговоре с заказчиком. Расшифровка не делает перевод дешевле — она делает его проверяемым. Появляется предмет, который можно показать редактору, по которому можно спорить о термине и к которому можно вернуться через полгода. Для заказчика это и есть разница между услугой и одолжением.

Сначала текст оригинала, перевод — вашими руками

Загрузите присланный файл: Vibe2Text вернёт расшифровку на языке записи — с разделением говорящих, временем у каждой реплики и возможностью прослушать любую строку. Выгрузка в DOCX, TXT, Markdown, SRT и VTT — дальше текст уходит в перевод.

Получить текст оригинала

Перевод сервис не выполняет. Старт без карты, файл до 4 ГБ и до 6 часов, рабочие языки — русский и английский.

Частые вопросы

Как перевести запись встречи, если заказчик прислал только аудиофайл?

В два шага. Сначала расшифровка на языке записи — с разделением говорящих, таймкодами и пометками там, где не слышно; потом перевод по этому тексту. Обратный порядок кажется быстрее, но лишает работу двух вещей сразу: возможности оценить объём до начала и возможности проверить результат чем-либо, кроме повторного прослушивания.

Расшифровка и перевод интервью — это одна услуга или две?

Две, и считаются они по-разному: расшифровка — по минутам записи, перевод — по знакам готового текста. Смешивать их в одну строку сметы опасно для исполнителя: пока текста нет, объём перевода неизвестен, а разброс между жанрами записи достигает кратных величин. В договорённости с заказчиком это обычно две позиции и два срока.

Сколько знаков получается из часа записи?

Универсальной цифры нет: доклад, переговоры с паузами и телефонный разговор дают разный объём. Считать надо по своему файлу — расшифровать десять минут не с начала записи, посмотреть число знаков с пробелами, поделить на 1800 и умножить на длительность. Коэффициент внутри одного жанра довольно устойчив, поэтому пересчитывать его каждый раз не нужно.

Что писать вместо неразборчивого слова?

Пометку с единым обозначением на весь документ — «[неразборчиво]» или «[нрзб.]», у длинных провалов с указанием длительности, и обязательно с таймкодом рядом. Почти разобранное слово помечается как предположение: «[предположительно: аллокация]». Подставлять правдоподобный вариант без пометки нельзя — через месяц догадку от расшифрованного не отличит уже никто, включая вас.

Как оформить перевод, чтобы заказчик видел оригинал?

Тремя способами: две колонки, чередование реплик или два файла с общей нумерацией сегментов. Выбор зависит от того, что человек будет делать с документом: сверять построчно, читать подряд или брать текст в дальнейшую работу. Общее для всех трёх — сквозная нумерация сегментов, одинаковая шапка и пометки, перенесённые в оба текста без изменений.

Почему переведённые субтитры не помещаются в реплику?

Потому что ограничение здесь двойное. Кроме длины строки — в русском руководстве Netflix это 42 знака и максимум две строки — действует скорость чтения: до 17 знаков в секунду для взрослой аудитории. Реплика на 2 секунды вмещает около 34 знаков независимо от того, сколько строк разрешено. Русский перевод английской фразы обычно длиннее, поэтому его сокращают, а не растягивают событие.

Можно ли переводить файл SRT целиком автоматическим переводчиком?

Переводить нужно только текстовые строки. Номера блоков и строки тайминга вида 00:01:12,340 --> 00:01:15,880 не трогают: время снято с записи и уже выверено по звуку, а автоматическая обработка файла целиком обычно ломает их форматирование, после чего плеер файл не открывает.

Проверено 15 августа 2026 года. Условная страница в 1800 печатных знаков с пробелами — по отраслевой практике, закреплённой в «Письменном переводе. Рекомендации переводчику и заказчику» Союза переводчиков России; там же печатными знаками считаются все видимые знаки и каждый пробел между словами. Обязательная ревизия вторым специалистом и то, что на устный перевод стандарт не распространяется, — по ISO 17100:2015 «Переводческие услуги. Требования к переводческим услугам». Пересчёт кадров в секунды сделан для 25 кадров в секунду: сами руководства задают пороги в кадрах, и при другой частоте кадров числа в секундах будут другими. Требования к субтитрам — по Russian Timed Text Style Guide (42 знака в строке, максимум две строки, скорость чтения до 17 знаков в секунду для взрослой аудитории и до 13 для детской, для SDH — 20 и 17) и Subtitle Timing Guidelines (минимум 20 кадров на событие, минимум 2 кадра между субтитрами).