
ГАЙД
Перевод аудиозаписи на русский: почему сначала делают расшифровку
Переводчику присылают не текст, а файл: интервью, переговоры, видео, запись заседания. Как разложить запись до начала перевода, как посчитать объём работы в минутах и знаках и как оформить двуязычный документ и субтитры.
Перевод аудиозаписи на русский начинается не с перевода
Заказчик присылает не документ, а файл: полтора часа переговоров, интервью с экспертом, видео с конференции, запись заседания. Перевод аудиозаписи на русский в такой постановке — это две работы, а не одна, и первая из них к переводу отношения не имеет: запись сначала надо разложить на текст, реплики и время. Дальше — про то, как эта первая часть устроена и почему её пропуск стоит дороже, чем она сама.
Оговорка, которая экономит время всем: слово «перевод» в русском рабочем обиходе означает две разные вещи. «Перевести запись в текст» — это расшифровка, тот же смысл, что «перевести деньги на счёт»; отсюда и запрос перевод аудио в текст с таймкодами, за которым стоит транскрибация, а не работа с иностранным языком. Прежде чем считать смету, стоит выяснить у заказчика, какое из двух значений он имел в виду: это две разные услуги с разной ценой.
Почему работа с голоса дороже, а не быстрее
Соблазн понятный: зачем набирать оригинал, если можно слушать и сразу писать по-русски. На коротком фрагменте это правда работает. На полутора часах переговоров ломается сразу в нескольких местах.
- Объём неизвестен до конца работы. Пока текста нет, вы не знаете, сколько в записи знаков: полтора часа доклада и полтора часа переговоров с паузами отличаются по объёму в разы. Смета «за минуту» перекладывает этот риск на кого-то одного, и обычно не на заказчика.
- Нельзя искать. Термин, который встретился на сороковой минуте, надо согласовать с тем, как вы перевели его на восьмой. По тексту это поиск, по записи — перемотка.
- Ничего не ложится в память переводов. Пары «сегмент оригинала — сегмент перевода» не возникает, и следующая запись того же заказчика начинается с нуля.
- Редактор не может проверить работу. Ему нечего сопоставлять: чтобы оценить перевод, придётся слушать те же полтора часа. На практике это означает, что проверки не будет.
- Правка стоит как повторное прослушивание. Замечание «на 47-й минуте не тот термин» без текста превращается в поиск по звуку.
- Спорное место негде обозначить. В тексте неразборчивый кусок помечается и обсуждается с заказчиком. В переводе с голоса он либо угадан, либо потерян, и заметить это некому.

Как считать объём: минуты записи против знаков текста
Главный источник убытков в таких заказах — единица измерения. Заказчик мыслит минутами, потому что у него на руках файл. Переводчик живёт в знаках, потому что от них зависит время работы. Связь между ними не постоянная: она зависит от темпа, пауз, количества говорящих и жанра записи.
| Единица | Что измеряет | Когда годится | Где подводит |
|---|---|---|---|
| Минута записи | Длину файла | Расшифровка, субтитры, тайминг | Молчание и паузы оплачиваются так же, как плотная речь |
| Условная страница, 1800 знаков | Объём готового текста | Перевод и редактура | До расшифровки объём неизвестен |
| Слово | Объём текста в англоязычной практике | Работа с зарубежным заказчиком | Русский и английский счёт слов не совпадают между собой |
| Час работы | Затраченное время | Вычитка, сверка терминов, оформление | Требует доверия и учёта, а не только договорённости |
Отсюда рабочая схема расчёта, которая не требует ни от кого верить на слово: объём считается по своей же записи, а не по средним цифрам из интернета.
- Расшифруйте 10 минут файла. Не первые десять — начало почти всегда разреженное: приветствия, проверка связи, представления.
- Посмотрите объём в знаках с пробелами. Текстовый редактор считает это одной командой; служебные подписи говорящих и таймкоды из подсчёта исключите.
- Переведите в страницы. Разделите на 1800 — получится, сколько условных страниц даёт десять минут именно этой записи.
- Умножьте на длину файла. Допустим, 10 минут дали 8400 знаков — это 4,7 страницы, а запись на 90 минут даёт около 42 страниц. С такой цифрой уже можно называть срок.
- Заложите отдельной строкой расшифровку и вычитку. Это работа до перевода, и она либо оплачивается, либо съедает маржу перевода.
- Проверьте коэффициент на втором заказе того же типа. У переговоров, лекции и телефонного разговора он разный и довольно устойчивый внутри жанра.
Что сделать с расшифровкой до того, как начнётся перевод
Сырая расшифровка — ещё не рабочий материал. Между «текст получен» и «можно переводить» лежат несколько операций, каждая из которых занимает минуты и экономит часы.
- Разложите реплики по говорящим и назовите роли. Не фамилии, а роли: «Интервьюер», «Эксперт», «Сторона А». В переводе от роли зависят и обращение, и регистр, и выбор «вы» или «ты».
- Проверьте, что у каждой реплики есть таймкод. Это единственный способ вернуться к спорному месту, не переслушивая файл, и единственный якорь для замечаний заказчика.
- Пройдите по именам, названиям и цифрам. Распознавание пишет незнакомое слово так, как услышало; ошибка здесь тихая — текст выглядит осмысленным.
- Соберите глоссарий до перевода, а не по ходу. Двадцать терминов, выписанных заранее, снимают половину правок редактора и всю разноголосицу внутри документа.
- Отметьте всё, что не разобрали. С таймкодом и без догадок — об этом отдельный раздел ниже.
- Согласуйте с заказчиком спорные места одним письмом. Список из десяти пунктов в начале работы дешевле десяти уточнений по ходу.

Термины, диалекты и то, что записано на слух
Устная речь отличается от письменного источника не только неполными предложениями. В ней есть слои, которых в документе не бывает, и каждый требует отдельного решения переводчика — до того, как он начнёт писать.
- Региональные варианты и диалектизмы. Решение принимается один раз на весь документ: передавать ли просторечие просторечием, или снимать окраску и оставлять смысл. Записывается в шапку файла, чтобы редактор не считал это ошибкой.
- Профессиональный жаргон. В речи он всегда плотнее, чем в документах той же отрасли: люди говорят сокращениями, которые вслух понятны, а на письме требуют расшифровки. Уточняется у заказчика вместе с глоссарием.
- Внутренние аббревиатуры и названия продуктов. Именно здесь распознавание ошибается чаще всего, и именно здесь ошибку труднее заметить в переводе.
- Смешанная речь. Вставки на другом языке внутри фразы — обычное дело в рабочих разговорах. Их отмечают в оригинале, а в переводе решают отдельно: сохранить, перевести или дать оба варианта.
- Числа, даты и суммы. Устная форма многозначна, а цена ошибки максимальная. Каждое такое место сверяется по звуку, а не по контексту.
- Оговорки и самопоправки. «Пятнадцатого… нет, шестнадцатого» — в дословном тексте остаются обе, в чистовом переводе только вторая. Что именно нужно заказчику, спрашивают заранее.
Отдельная тема — от чего вообще зависит качество исходного текста: акцент, темп, канал записи и переключение языков внутри одной дорожки разобраны в статье расшифровка аудио на иностранном языке. Для переводчика вывод оттуда практический: чем хуже звук, тем длиннее будет список мест, которые придётся согласовывать с заказчиком, и это оценивается до начала работы.
«Неразборчиво» — это профессиональная норма, а не брак
Начинающий исполнитель прячет непонятое место: подставляет правдоподобное слово и идёт дальше. Опытный помечает. Разница видна не в момент сдачи, а через месяц, когда выясняется, что в правдоподобном слове был весь смысл абзаца.
Как это оформляют, чтобы пометка читалась одинаково всеми:
- Единое обозначение на весь документ. «[неразборчиво]» или «[нрзб.]» — важно не какое, а чтобы одно; список условных обозначений выносится в шапку.
- Длительность у длинных провалов. «[неразборчиво, 6 с]» говорит заказчику, потерян ли оборот или потерян абзац.
- Таймкод рядом. Пометка без времени бесполезна: проверить её нельзя, а значит, и снять вопрос нельзя.
- Неречевые события — тоже в скобках. «[говорят одновременно]», «[пауза]», «[смех]» объясняют, почему кусок не разобран, и снимают подозрение в невнимательности.
- Предположение помечается как предположение. Если слово почти разобрано, пишут «[предположительно: аллокация]», а не «аллокация».
- Список пометок выносится сопроводительным письмом. Десять строк с временем — и заказчик, который был на встрече, закрывает половину за пять минут.
Как оформить двуязычный документ
Заказчику почти всегда нужен не перевод вместо оригинала, а оба текста рядом: он хочет видеть, откуда взялась формулировка. Раскладок три, и выбор между ними определяется не вкусом, а тем, что человек будет с документом делать.
| Раскладка | Кому удобна | Чем неудобна |
|---|---|---|
| Две колонки: оригинал слева, перевод справа | Тому, кто сверяет построчно: юристу, редактору, заказчику со знанием языка | Ломается при печати и на телефоне, длинные реплики разъезжаются |
| Чередование: реплика оригинала, под ней перевод | Тому, кто читает подряд и иногда заглядывает в оригинал | Документ вдвое длиннее, читать сплошняком тяжело |
| Два отдельных файла с общей нумерацией сегментов | Тому, кто работает с текстом дальше: монтаж, цитаты, публикация | Требует дисциплины: нумерация должна совпадать до конца |
- Пронумеруйте сегменты в оригинале до перевода. Номер — единственная связь между двумя текстами, которая переживёт любое переформатирование.
- Таймкоды оставьте только в оригинале. Дублировать их в переводе незачем: время относится к записи, а не к языку.
- Сделайте шапку одинаковой в обоих файлах. Что за запись, длительность, кто говорит, какие условные обозначения приняты, дата работы.
- Пометки переносите в перевод как есть. «[неразборчиво, 6 с]» должно стоять в обоих текстах в одном и том же сегменте, иначе документы разъедутся.
- Комментарий переводчика — отдельным слоем. Сноска или колонка примечаний, но не текст внутри реплики: смешанные слои через месяц не разделяются.
- Отдавайте в редактируемом формате. DOCX для документа, TXT или Markdown — если текст пойдёт в дальнейшую обработку.

Субтитры на втором языке: что нельзя трогать и во что надо уложиться
Если заказчику нужны не документ, а субтитры, работа меняется сильнее, чем кажется. Перевод для субтитров — не перевод текста, а перевод в рамку: у каждой реплики есть окно по времени, и текст обязан в него поместиться.
Первое правило механическое. В файле SRT переводят только текстовые строки, не трогая ни номера блоков, ни строки тайминга вида 00:01:12,340 --> 00:01:15,880. Тайминг снят с оригинальной записи и уже выверен по звуку; если отдать файл целиком в автоматический перевод, форматирование тайминг-строк обычно ломается, и плеер такой файл не открывает.
Второе правило — про ограничения, которые в текстовом переводе не встречаются. Ориентиром служат опубликованные требования вещателей; у Netflix русское руководство по таймированному тексту задаёт их прямо:
- 42 знака в строке и не больше двух строк в одном субтитре.
- Скорость чтения — до 17 знаков в секунду для взрослой аудитории и до 13 для детской; для субтитров с описанием звуков пределы выше — 20 и 17.
- Минимальная длительность события — 20 кадров: при 25 кадрах в секунду это 0,8 секунды.
- Минимальный зазор между соседними субтитрами — 2 кадра; промежутки от 3 до 11 кадров сводят к двум кадрам либо растягивают до 0,5 секунды.
Из этих чисел следует то, что обычно обнаруживают уже в процессе: первым упирается не лимит строки, а скорость чтения. Реплика длиной 2 секунды при пределе 17 знаков в секунду вмещает около 34 знаков — то есть меньше одной полной строки, хотя формально разрешено две по 42. А русский перевод английской фразы почти всегда длиннее оригинала.
Что просить у заказчика вместе с записью
Половина проблем с такими заказами решается тремя вопросами, заданными до начала работы. Задавать их неудобно ровно один раз.
- Глоссарий или прошлые материалы. Даже кривая табличка терминов от заказчика лучше, чем ваши догадки о том, как у них принято.
- Написание имён. Фамилии участников в письменном виде — минута работы заказчика и полчаса вашей.
- Что делать с оговорками и словами-паразитами. Дословный текст и причёсанный — разные документы, и решает это заказчик, а не исполнитель.
- Срок и форма приёмки. Кто вычитывает результат и по какому критерию: без ответа приёмка превращается в переписку.
Файл получил, длительность ___ , предварительно берусь. Чтобы назвать срок и сумму, уточню шесть вещей. 1. Что нужно на выходе: двуязычный документ, только перевод или субтитры? От этого зависят и формат, и цена. 2. Текст дословный или причёсанный — с оговорками и повторами или без них? 3. Кто говорит: список участников с ролями и написанием фамилий. 4. Тема и глоссарий: термины, названия продуктов, внутренние сокращения — даже черновой табличкой. 5. Есть ли оригинал файла, не пересланный через мессенджер? Пересжатие бьёт по разборчивости сильнее акцента. 6. Кто принимает работу и по какому критерию, срок сдачи: ___ Порядок работы: сначала расшифровка на языке записи с таймкодами и пометками [неразборчиво], затем перевод по выверенному тексту. Объём в страницах назову после первых 10 минут расшифровки — по ним считается коэффициент именно этой записи. Смета будет из двух строк: расшифровка — по минутам записи, перевод — по страницам 1800 знаков.
Шесть вопросов, заданных до начала, заменяют десять уточнений по ходу и снимают спор о цене на приёмке.
Маршрут целиком
Если собрать всё вместе, работа выглядит так — и первые два шага занимают меньше времени, чем кажется, а экономят больше всего.
- Текст оригиналаговорящие, таймкоды, пометки
- Вычитка и глоссарийимена, термины, цифры
- Переводпо выверенному тексту, а не с голоса
- Сдачадвуязычный документ или субтитры
Про первый шаг стоит сказать прямо, чтобы не было недоразумений: сервис отдаёт текст на языке оригинала, а не перевод. Он раскладывает запись по говорящим, ставит время у каждой реплики и позволяет прослушать любую строку из текста; перевод дальше делаете вы — руками, кошкой или языковой моделью, по выверенному оригиналу. Рабочие языки — русский и английский; как обрабатывается запись не на родном языке, показано на странице многоязычная расшифровка аудио и видео, а англоязычный материал — на странице английская речь в текст.

И последнее, что стоит держать в голове при разговоре с заказчиком. Расшифровка не делает перевод дешевле — она делает его проверяемым. Появляется предмет, который можно показать редактору, по которому можно спорить о термине и к которому можно вернуться через полгода. Для заказчика это и есть разница между услугой и одолжением.
Сначала текст оригинала, перевод — вашими руками
Загрузите присланный файл: Vibe2Text вернёт расшифровку на языке записи — с разделением говорящих, временем у каждой реплики и возможностью прослушать любую строку. Выгрузка в DOCX, TXT, Markdown, SRT и VTT — дальше текст уходит в перевод.
Получить текст оригиналаПеревод сервис не выполняет. Старт без карты, файл до 4 ГБ и до 6 часов, рабочие языки — русский и английский.
Частые вопросы
Как перевести запись встречи, если заказчик прислал только аудиофайл?
В два шага. Сначала расшифровка на языке записи — с разделением говорящих, таймкодами и пометками там, где не слышно; потом перевод по этому тексту. Обратный порядок кажется быстрее, но лишает работу двух вещей сразу: возможности оценить объём до начала и возможности проверить результат чем-либо, кроме повторного прослушивания.
Расшифровка и перевод интервью — это одна услуга или две?
Две, и считаются они по-разному: расшифровка — по минутам записи, перевод — по знакам готового текста. Смешивать их в одну строку сметы опасно для исполнителя: пока текста нет, объём перевода неизвестен, а разброс между жанрами записи достигает кратных величин. В договорённости с заказчиком это обычно две позиции и два срока.
Сколько знаков получается из часа записи?
Универсальной цифры нет: доклад, переговоры с паузами и телефонный разговор дают разный объём. Считать надо по своему файлу — расшифровать десять минут не с начала записи, посмотреть число знаков с пробелами, поделить на 1800 и умножить на длительность. Коэффициент внутри одного жанра довольно устойчив, поэтому пересчитывать его каждый раз не нужно.
Что писать вместо неразборчивого слова?
Пометку с единым обозначением на весь документ — «[неразборчиво]» или «[нрзб.]», у длинных провалов с указанием длительности, и обязательно с таймкодом рядом. Почти разобранное слово помечается как предположение: «[предположительно: аллокация]». Подставлять правдоподобный вариант без пометки нельзя — через месяц догадку от расшифрованного не отличит уже никто, включая вас.
Как оформить перевод, чтобы заказчик видел оригинал?
Тремя способами: две колонки, чередование реплик или два файла с общей нумерацией сегментов. Выбор зависит от того, что человек будет делать с документом: сверять построчно, читать подряд или брать текст в дальнейшую работу. Общее для всех трёх — сквозная нумерация сегментов, одинаковая шапка и пометки, перенесённые в оба текста без изменений.
Почему переведённые субтитры не помещаются в реплику?
Потому что ограничение здесь двойное. Кроме длины строки — в русском руководстве Netflix это 42 знака и максимум две строки — действует скорость чтения: до 17 знаков в секунду для взрослой аудитории. Реплика на 2 секунды вмещает около 34 знаков независимо от того, сколько строк разрешено. Русский перевод английской фразы обычно длиннее, поэтому его сокращают, а не растягивают событие.
Можно ли переводить файл SRT целиком автоматическим переводчиком?
Переводить нужно только текстовые строки. Номера блоков и строки тайминга вида 00:01:12,340 --> 00:01:15,880 не трогают: время снято с записи и уже выверено по звуку, а автоматическая обработка файла целиком обычно ломает их форматирование, после чего плеер файл не открывает.
Проверено 15 августа 2026 года. Условная страница в 1800 печатных знаков с пробелами — по отраслевой практике, закреплённой в «Письменном переводе. Рекомендации переводчику и заказчику» Союза переводчиков России; там же печатными знаками считаются все видимые знаки и каждый пробел между словами. Обязательная ревизия вторым специалистом и то, что на устный перевод стандарт не распространяется, — по ISO 17100:2015 «Переводческие услуги. Требования к переводческим услугам». Пересчёт кадров в секунды сделан для 25 кадров в секунду: сами руководства задают пороги в кадрах, и при другой частоте кадров числа в секундах будут другими. Требования к субтитрам — по Russian Timed Text Style Guide (42 знака в строке, максимум две строки, скорость чтения до 17 знаков в секунду для взрослой аудитории и до 13 для детской, для SDH — 20 и 17) и Subtitle Timing Guidelines (минимум 20 кадров на событие, минимум 2 кадра между субтитрами).