Простая загрузка
Выберите файл и нажмите запуск — больше ничего не нужно.
Транскрибация встреч, интервью, звонков и лекций — со спикерами, таймкодами и кратким содержанием.
Загрузите запись — транскрибация идёт прямо в браузере, со спикерами, таймкодами и экспортом.
Попробовать бесплатноВыберите файл и нажмите запуск — больше ничего не нужно.
Можно загрузить сразу несколько аудио и видео за один заход.
FAQ
На чистой речи на русском и английском в среднем 8% ошибок — это уровень хорошей нейросети для распознавания речи. Текст готов к лёгкой правке, а не к переписыванию с нуля.
Да. Распознавание речи обучено на живой речи, поэтому понимает русский с региональным акцентом, английский с разным произношением и смешанные фразы. На сильном акценте ошибок чуть больше, но текст остаётся читаемым.
Да, сервис автоматически делит запись разговора в текст по голосам и подписывает реплики «Спикер 1», «Спикер 2». Имена меняются кликом и применяются ко всему тексту сразу.
Уверенно различает до 10 голосов на одной записи — этого хватает на совещания, фокус-группы и подкасты. На больших панельных дискуссиях имена удобно править вручную в редакторе.
Да. На записях с улицы, из переговорной или с шумом из Zoom расшифровка остаётся читаемой. На сильном шуме ошибок чуть больше, но контекст и спикеры сохраняются.
Да, если шёпот слышен в записи без сильных провалов громкости. На очень тихих кусках сервис может пометить пропуск — тогда достаточно ускорить громкость в плеере и перезагрузить файл.
Да. Запись разговора в текст с диктофона телефона, с записи звонка из IP-телефонии или с плохой связи сервис обрабатывает корректно, хотя ошибок будет чуть больше, чем на студийной записи.
Русский, английский, испанский, немецкий, французский, итальянский, китайский, японский, арабский и ещё больше 90 языков. Язык можно указать вручную или оставить выбор сервису.
Да. Если на встрече переключаются между языками или используют англицизмы и термины, сервис понимает оба языка и собирает один общий текст без потерь.
Базовый словарь покрывает большинство профессиональных терминов в RU и EN. Для редких слов и аббревиатур есть глоссарий: добавляете свои термины, и сервис подставляет их в текст без опечаток.
Любую опечатку чините прямо в редакторе — изменение сохраняется к этому тексту. А в глоссарии можно один раз закрепить имена сотрудников, продукты и термины, чтобы они автоматически распознавались в будущих расшифровках.
MP3, WAV, M4A, OGG, OPUS, FLAC, AAC, AMR, WMA и голосовые из мессенджеров. Перевод mp3 в текст и расшифровка диктофонных записей идут через одну общую загрузку.
Да. MP3 — самый частый формат для диктофона и подкастов, сервис переводит MP3 в текст с таймкодами и спикерами за 5–10 минут на каждый час аудио.
Да, файл WAV в текст загружается так же, как MP3, и распознаётся даже точнее за счёт несжатого качества. Подходит для студийных записей, подкастов и записей с микрофона.
Да. Запись с диктофона iPhone сохраняется в M4A и загружается напрямую — отдельная конвертация в MP3 не нужна. Так быстрее всего перевести аудио с телефона в текст.
Да. Голосовые из Telegram, WhatsApp и других мессенджеров сохраняются в OGG/OPUS — сервис распознаёт их напрямую и выдаёт текст за секунды.
Да, сервис вытаскивает звуковую дорожку из MP4, MOV, MKV, WebM и AVI и делает транскрибацию видео в текст. Отдельно конвертировать ничего не нужно.
Да. Сохраните голосовое из WhatsApp в файл или перешлите в чат-бот — перевод голосового сообщения в текст занимает несколько секунд и сохраняется в вашем кабинете.
Да. Telegram голосовое в текст работает через прямую загрузку файла. Telegram голосовые сообщения в текст превращаются за секунды — даже длинные кружочки и audio-сообщения.
До 4 ГБ и до 6 часов на один файл — это полноценный вебинар в HD или длинная конференция. Длинные записи сервис автоматически бьёт на части и собирает обратно в один документ.
До 6 часов на один файл, чего хватает почти на любое совещание, лекцию или интервью. Если нужно больше — разбейте запись на части и загрузите подряд, тексты соберутся в один документ через папку.
Да, файлы добавляются в очередь и обрабатываются параллельно. Можно одновременно лить десятки записей — сервис распределит нагрузку и не потеряет порядок.
Да. Длинная лекция, интервью или совещание загружаются одним файлом — сервис не теряет контекст и держит таймкоды по всей длине. Спикеры тоже остаются стабильными от начала до конца.
WAV-файл загружается как есть, без перекодирования — несжатое аудио даёт чуть выше точность, чем MP3 или OGG. После расшифровки результат можно скачать в DOCX, SRT, TXT, JSON или Markdown.
Стандартные диктофоны Android пишут в M4A, AMR или 3GP — все три формата принимаются напрямую. Если диктофон сохраняет в нестандартный кодек, сервис всё равно вытащит звуковую дорожку.
Да. Вставьте ссылку на видео — сервис сам скачает дорожку и сделает расшифровку. Так работает расшифровка видео с YouTube, RuTube, VK Видео и других площадок.
Да. Вставьте ссылку на ролик — сервис скачает звуковую дорожку и вернёт текст с таймкодами и спикерами. Так же удобно готовить конспекты по роликам с ютуба.
Да. Видео с RuTube расшифровывается так же, как с YouTube, — нужно только вставить ссылку. Полезно для тех, кто публикует контент в RU-площадках и хочет быстро получить расшифровку.
Да. Видео из VK и записи из Дзен загружаются по ссылке, скачивать их не нужно. Сервис достаёт аудио и сразу делает расшифровку с разделением спикеров.
Да. Скачайте файл записи Zoom (MP4 или M4A) и загрузите его — сервис расшифрует встречу и сразу соберёт протокол совещания с задачами и решениями.
Да — файлом. Скачайте запись встречи из Google Meet или Microsoft Teams и загрузите её: на выходе текст со спикерами, краткое содержание и задачи. Заходить на созвон ботом сервис умеет в Телемост, MTS Link, SaluteJazz и Контур.Толк.
Да. Расшифровка встречи в Яндекс Телемост, МТС Линк и других российских ВКС — это базовый сценарий сервиса. Загрузите файл записи или ссылку и сразу получите протокол совещания.
Да. Файл записи из Skype, Discord или TeamSpeak загружается напрямую, и сервис разделит участников по голосам. Если в записи много спикеров, имена удобно проставить кликом в редакторе.
Скачайте файл из Google Drive или Яндекс Диска и загрузите его — или вставьте прямую ссылку на медиафайл, и сервис заберёт его сам. Для больших файлов удобно использовать прямую ссылку на скачивание.
Скачивать вручную необязательно: сервис сам скачает дорожку по ссылке. Если ролик уже у вас на диске, просто перетащите файл в окно — расшифровка и таймкоды будут такими же.
Да. Вставьте ссылку на встречу — бот подключится, запишет звонок и пришлёт расшифровку ВКС со спикерами, таймкодами и готовым протоколом встречи. Поддерживаем Яндекс Телемост, MTS Link, SaluteJazz (SberJazz) и Контур.Толк, а из протокола сразу видны решения и задачи.
Час аудио обрабатывается примерно за 5–10 минут — это в десятки раз быстрее, чем у фрилансера. Короткие голосовые из мессенджеров расшифровываются за 5–20 секунд.
Обычно 5–10 минут на час записи. Это в разы быстрее, чем ручная расшифровка часа аудио, которая занимает 5–8 часов работы — и без переписки с исполнителем.
Сейчас сервис работает с готовыми файлами и ссылками — это даёт самое высокое качество расшифровки. Живая диктовка и потоковая транскрибация появятся в следующих обновлениях.
Файлы попадают в очередь и обрабатываются параллельно — отдельные пользователи не мешают друг другу. На тарифах Pro и Team приоритет в очереди выше, чем у бесплатных загрузок.
Большие файлы обрабатываются быстро — даже многочасовая запись будет готова в разы быстрее, чем её длительность. Настраивать ничего не нужно: вы загружаете файл и получаете готовый текст.
Голосовое сообщение длительностью 30–60 секунд расшифровывается за 5–20 секунд. Удобно для расшифровки потока голосовых из Telegram или WhatsApp в течение рабочего дня.
Да. Каждая реплика подписана номером спикера, имена редактируются в один клик и применяются ко всему тексту. Особенно удобно при расшифровке встречи, интервью и круглого стола.
Да. По клику на абзац плеер перематывается к нужной секунде, поэтому легко сверять расшифровку с оригиналом. Таймкоды экспортируются вместе с текстом в JSON и SRT.
Да. Готовые субтитры в формате SRT выгружаются одним кликом — их можно загрузить в YouTube, VK Видео, RuTube и любой видеоредактор. SRT субтитры онлайн поддерживают перевод на другие языки прямо в кабинете.
Да, формат WebVTT генерируется параллельно с SRT. Это нужно для веб-плееров, HLS-стримов и плагинов соцсетей — субтитры вы получаете сразу в обоих форматах.
Сначала сервис делает расшифровку, а субтитры собираются из неё автоматически по таймкодам. Сам текст можно не открывать: достаточно скачать SRT и VTT кнопкой экспорта.
Да. После расшифровки одним кликом получаете краткое содержание видео: ключевые тезисы, темы и решения. Саммари по видео готово за минуту.
Да. Сервис сам собирает протокол совещания: тезисы, решения и список задач с ответственными и дедлайнами. По форме это близко к классическому протоколу — готовый образец лежит в шаблонах.
Да. В отчёте видно отдельным блоком, кто что пообещал и к какой дате — список задач можно сразу переносить в Jira, Trello, Notion или таск-трекер команды.
DOCX, PDF, TXT, Markdown, JSON и субтитры SRT/VTT — всё доступно одной кнопкой в редакторе. Можно выгрузить как чистый текст, так и версию с таймкодами и спикерами.
Да. DOCX открывается в Word, Pages и Яндекс Документах с сохранением стилей и спикеров. PDF удобен для отправки клиенту или согласования — макет постраничный, без перекомпоновки.
Да. Готовый текст можно перевести на английский, испанский, немецкий, французский, китайский и другие языки — оригинал остаётся рядом для сверки. Удобно для международных команд и подкастов.
Да. Встроенный чат отвечает по содержанию записи: «о чём говорили в 25-й минуте», «какие были возражения», «кто за что отвечает». Так удобно искать конкретные моменты, не пролистывая весь текст.
Да. Сквозной поиск находит фразы по всем сохранённым записям и сразу подсвечивает контекст с таймкодами. Удобно журналистам, исследователям и продактам, у кого десятки интервью.
Да. В глоссарии закрепляются термины, имена сотрудников, продукты и сокращения — и сервис подставляет их в текст без опечаток. Это сильно повышает точность для нишевых тем.
Да. Редактор работает по принципу «click-to-seek»: ткнули в слово — плеер встал на эту секунду. Так удобно сверять сложные моменты и править стенограмму без перематывания вручную.
Да. Версии правок сохраняются автоматически: можно откатиться назад и посмотреть, что менялось. Снимки живут 7 дней — этого хватает, чтобы отменить ошибку, но вернуться к версии месячной давности нельзя.
Да, сервис собирает протокол совещания по записи аудио или видео: повестка, ключевые тезисы, принятые решения и поручения с ответственными. Готовый протокол можно скачать в DOCX или PDF и согласовать без переписывания вручную.
Шаблон протокола включает дату, участников, вопросы повестки, краткое содержание обсуждения, решения и поручения. Структура близка к классическому образцу протокола рабочего или оперативного совещания и принимается в большинстве организаций без правок.
Подходит: на оперативке, планёрке или совещании при директоре сервис разделит спикеров, зафиксирует поручения и сроки, а ответственный секретарь получит протокол сразу после встречи, а не через два дня.
Сервис выделяет фразы с явными решениями, дедлайнами и ответственными — «Иван готовит отчёт до пятницы» превращается в строку поручения. Список можно отредактировать, а весь протокол выгрузить в DOCX, PDF, Markdown или JSON.
Загрузите видеофайл (MP4, MOV, MKV, WebM) или вставьте ссылку на YouTube/RuTube/VK Видео — сервис извлечёт звук, распознает речь и вернёт текст с таймкодами и разделением по спикерам. Большие видео обрабатываются по частям, ничего скачивать на компьютер не нужно.
Да. Англоязычная запись распознаётся в английский текст, а перевод на русский можно запросить в чате по записи — попросите перевести нужный кусок или весь разговор.
Вставьте ссылку на YouTube-видео на другом языке — сервис расшифрует оригинальную речь и сделает русский перевод текста и субтитров SRT/VTT. Удобно для иностранных лекций, подкастов и интервью без официальных русских субтитров.
Загрузите файл с диктофона, созвона или камеры — либо вставьте ссылку на запись. Дальше всё происходит само: сервис распознаёт слова, расставляет знаки препинания, делит реплики по спикерам и проставляет таймкоды. Готовый текст открывается в редакторе: там же краткое содержание, задачи и решения, чат по расшифровке и экспорт в DOCX, PDF, TXT, Markdown, JSON, SRT и VTT.
Исходное аудио хранится 45 дней, версия для прослушивания — 210 дней, текст расшифровки — 180 дней, снимки правок — 7 дней. Удалить запись и текст можно раньше, кнопкой в кабинете: удаление окончательное.
Вы и те, кому вы сами открыли доступ.
Файлы и расшифровки хранятся на серверах в РФ. Передача идёт по зашифрованному каналу.
Данные хранятся на территории Российской Федерации. Передача идёт в зашифрованном виде.
Аудио хранится 45 дней, версия для прослушивания — 210 дней, текст расшифровки — 180 дней, снимки правок — 7 дней. Затем данные удаляются автоматически. Кнопка удаления есть рядом с каждой расшифровкой — файл стирается из хранилища без возможности восстановления.
Да. Доступ к файлу есть только у вас, передача шифруется (HTTPS/TLS). Конфиденциальность аудио и расшифровок поддерживается на уровне инфраструктуры.
Только те, кого вы пригласили, — с ролями «владелец», «администратор», «участник» и «наблюдатель». Доступ выдаёте и отзываете вы; человек без приглашения не увидит ни файлов, ни расшифровок.
С аккаунтом минуты на запуске не считаются вовсе: ни карты, ни подписки, ни лимита по времени — можно загрузить и одно интервью, и партию созвонов. Без регистрации доступны две записи и 60 минут суммарно, и такая расшифровка хранится сутки. Когда бесплатный запуск закончится, предупредим заранее.
Сейчас транскрибация аудио в текст бесплатна: карта не нужна, ограничений по минутам на запуске нет. Загрузите файл до 4 ГБ и до 6 часов, получите текст со спикерами, таймкодами, кратким содержанием и списком задач, скачайте DOCX, PDF, TXT, Markdown, JSON, SRT или VTT. Если запуск сменится платными пакетами минут, стоимость мы покажем заранее и без автосписаний.
Да. На запуске транскрибация доступна всем бесплатно, без карты и подписки: регистрируетесь, загружаете аудио или видео, забираете текст. Ставить на компьютер ничего не нужно — аудио переводится в текст прямо в браузере, файл обрабатывается на наших серверах, а результат открывается в редакторе, где можно поправить слова, переименовать спикеров и выгрузить документ или субтитры.
Да, это базовый сценарий. Сервис делает расшифровку встречи в Яндекс Телемост, Zoom, Google Meet, МТС Линк и других ВКС, а на выходе — протокол совещания, задачи и решения.
Да. Расшифровка интервью в текст — типовой сценарий: сервис автоматически делит вопросы и ответы по спикерам и проставляет таймкоды. Цитаты можно выделять прямо в редакторе и экспортировать пакетом.
Да. Расшифровка подкаста идёт со спикерами, главами и тегами тем — удобно делать показ-нотс и анонсы. Готовый текст экспортируется в Markdown или DOCX для CMS и платформ дистрибуции.
Да. Расшифровка лекций — частый сценарий у студентов и преподавателей: получаете полный текст и краткое содержание, по которому удобно учиться. Таймкоды помогают быстро вернуться к нужному фрагменту.
Да. Расшифровка звонков и запись звонка в текст работают со стандартными форматами IP-телефонии и CRM (MTS, MANGO, UIS, Битрикс). На выходе можно собрать сводку по возражениям, целям и обещаниям менеджера.
Да. В юридической работе важна точность цитат и привязка к таймкоду — сервис даёт оба. Данные хранятся на территории РФ, доступ только у владельца.
Да. Расшифровка интервью онлайн, фокус-группы и глубинных интервью — то, ради чего сервис задумывался. Можно искать по всем интервью, тегировать цитаты и собирать сводный отчёт по темам.
Да, при условии согласия пациента и соблюдения локальных норм. Данные хранятся на территории РФ, аудио можно удалить сразу после готовности текста, а в глоссарии заранее закрепляются медицинские термины.
Нет. Первая расшифровка запускается без аккаунта: выбираете файл и получаете текст. Почту попросим позже — чтобы записи не удалились через сутки и открывались с любого устройства.
Всё работает прямо в браузере — Chrome, Safari, Firefox, Edge на любой ОС. Отдельных приложений ставить не нужно, а на мобильном веб-версия адаптирована под загрузку с телефона.
Да, API расшифровки даёт загружать файлы, получать текст и саммари из своих систем. Документация доступна в разделе помощи, авторизация по API-ключу, ответы — в JSON.
Да. Когда расшифровка готова, сервис шлёт webhook на ваш URL с метаданными — можно сразу запустить отправку клиенту, сохранение в CRM или импорт в редактор.
Через API и webhooks вы можете забирать готовые расшифровки в свой сервис. Прямые интеграции с Notion, Битрикс24 и amoCRM — в планах.
Русский язык распознаётся точнее, интерфейс на русском, оплата картой РФ, данные хранятся на территории РФ. Это критично для компаний с требованиями к безопасности данных.
Встроенная транскрибация Zoom и Telemost даёт сырой текст без редактора, поиска, экспорта в DOCX/SRT и без саммари с задачами. Сервис собирает полный документ под совещание, а не только дорожку слов.
Расширения часто работают на чужом облаке и шлют ваш файл куда попало. Сервис обрабатывает и хранит данные на серверах в РФ, поэтому пригоден для рабочих записей с конфиденциальной информацией.
Сервис заточен на расшифровку готовых записей, а не на потоковый голосовой ввод в реальном времени. Если нужно набрать длинный текст голосом — наговорите его в диктофон телефона и загрузите файл: получите вычитанный текст без поправок системного голосового ввода.
Да, любая запись с диктофона телефона, ноутбука или профессионального рекордера превращается в текст: M4A с iPhone, AMR/3GP с Android, WAV и MP3 с внешних диктофонов. Подходит и для длинных диктофонных записей лекций или интервью.
Системный голосовой ввод путает спикеров, теряет окончания на длинных фразах и не работает с готовыми файлами. Сервис обрабатывает запись целиком, разделяет реплики, расставляет пунктуацию и даёт текст под редактирование, а не сырую ленту слов.
Ничем — это два названия одной операции: перевода устной речи из аудио или видео в письменный текст. «Расшифровка» чаще говорят про интервью, суды и совещания, «транскрибация текста» — про заказ у фрилансера или в сервисе. Vibe2Text делает транскрибацию онлайн автоматически: распознавание речи, разделение спикеров, таймкоды и экспорт — без ручного набора и многочасовой возни с плеером.
Fireflies и Otter заточены на английский и встречи в Google Meet/Zoom, оплата картой РФ у них недоступна, а данные хранятся за границей. Сервис нативно распознаёт русский с пунктуацией, принимает любые форматы файлов и ссылок, данные хранятся на территории РФ.
Да. Пришлите боту голосовое, аудио, видео или ссылку на встречу прямо в чат — и получите расшифровку, краткое содержание и список задач. Бот делает расшифровку голосовых сообщений и переводит голосовое в текст, а ещё умеет экспорт и чат по расшифровке.
Ручная транскрибация текста — это когда человек слушает запись и набирает её с клавиатуры: час аудио занимает четыре-шесть часов работы. Автоматическая возвращает черновик за минуты, а вычитку вы делаете сами в редакторе, где подсвечены таймкоды и можно слушать фрагмент рядом с текстом. На чистой речи правок немного; на шумных записях с перебивками вычитка всё ещё нужна.