JSON со структурой
В ответе — реплики, спикеры, таймкоды слов и языковые метки. Удобно для парсинга и аналитики.
API
API запускает расшифровку, возвращает текст со спикерами и таймкодами и присылает события по статусу обработки.
В ответе — реплики, спикеры, таймкоды слов и языковые метки. Удобно для парсинга и аналитики.
Сервис сам присылает события о готовности расшифровки, ошибках и экспорте.
API отдаёт тот же DOCX, TXT, SRT и VTT, что и веб-интерфейс.
Повторный запрос с тем же файлом не запускает обработку заново и не списывает минуты.
Кому подходит
Встречи, задачи и решения в тексте.
Интервью, цитаты и заметки рядом с аудио.
Подкасты, видео, субтитры и черновики.
Лекции, вебинары и конспекты.
Подробно о задаче
Ручная загрузка аудио через сайт хороша, пока файлов десятки. Но у команды, которая обрабатывает звонки контакт-центра, поток вебинаров или архив видеоуроков, счёт идёт на сотни записей в день, и человек в этой цепочке становится узким местом. Разработчику нужно, чтобы расшифровка сама запускалась из бэкенда, а готовый текст со спикерами прилетал обратно в CRM, таск-трекер или базу знаний без единого клика. Именно здесь помогает API для разработчиков: он снимает рутину загрузки и позволяет вписать транскрибацию в существующий конвейер. Без него приходится держать оператора, который вручную скачивает файлы, ждёт обработку и копирует текст в нужную систему, теряя часы каждый день.
Схема простая и предсказуемая. Сначала в разделе настроек разработчика создаётся ключ доступа — его кладут в секреты своего сервиса. Дальше запрос на создание задачи принимает либо сам файл, либо ссылку на запись; в ответ приходит идентификатор задачи. Пока идёт распознавание, не нужно держать открытое соединение: сервис сам присылает событие о готовности на ваш webhook, а по идентификатору можно забрать результат в любой момент. На выходе — структурированный JSON с репликами, метками спикеров и таймкодами слов, а также готовые файлы DOCX, TXT, SRT и VTT. Диаризация уже разложила разговор по голосам, так что в CRM попадает не сплошная стена текста, а аккуратный диалог с абзацами.
Частая ошибка новичка — опрашивать статус задачи в цикле каждую секунду. Это лишняя нагрузка: подпишитесь на события и реагируйте на них, а long polling оставьте как запасной путь. Второй момент — идемпотентность: повторная отправка того же файла не запускает обработку заново, поэтому смело настраивайте ретраи на своей стороне, дубли минут не спишутся. Обязательно логируйте идентификаторы задач и типы ошибок — типизированные коды помогают отличить проблему формата от проблемы сети. И проверяйте webhook на боевом сервере, а не только локально: подпись события нужно валидировать, иначе в конвейер попадёт чужой запрос. Начните с одного тестового файла и убедитесь, что весь путь от загрузки до экспорта отрабатывает end-to-end.
Выберите тип записи, формат или рабочий процесс.
Частые вопросы
Заведите ключ доступа в разделе настроек разработчика и сохраните его в секретах своего сервиса. Затем отправьте первый запрос с файлом или ссылкой, получите идентификатор задачи и заберите готовый JSON. Перед боевой интеграцией прогоните один тестовый файл через весь путь — от загрузки до экспорта.
Основной ответ — структурированный JSON: реплики с текстом, метки спикеров после диаризации, таймкоды на уровне слов и языковые метки. Из этого же результата доступны файлы DOCX, TXT, SRT и VTT, поэтому субтитры или протокол собираются без дополнительной обработки на вашей стороне.
Нет. Подпишитесь на webhooks — сервис сам пришлёт событие transcript.completed, когда расшифровка готова, а также export.completed после сборки файла. Опрос по идентификатору задачи стоит держать как запасной вариант на случай, если событие не дошло из-за сетевого сбоя.
Повторная отправка того же файла не запускает распознавание заново и не списывает минуты повторно — сработает идемпотентность. Это удобно для ретраев: если ваш сервис не получил ответ из-за таймаута, можно спокойно повторить запрос, дубликата обработки не возникнет.
Да, старт бесплатный и без карты. Первую расшифровку можно сделать прямо с главной страницы, чтобы оценить качество, а затем перейти к интеграции по ключу. Русский — основной язык распознавания, другие языки тоже поддерживаются, что удобно для мультиязычных потоков.
Vibe2Text
Загрузите аудио или видео, пока на запуске сервис открыт бесплатно.