Переводим видеозаписи в текст там, где ошибка дорого стоит: совещания и интервью, вебинары и обучающие курсы, судебные заседания и записи фокус-групп. Отдаём готовый транскрипт с тайм-кодами и разделением по спикерам, а при необходимости — субтитры в SRT или VTT. Автоматическое распознавание используем как черновик, финальный текст вычитывает человек.

Работаем с записями, где важна дословность и структура: деловыми совещаниями, интервью и фокус-группами, вебинарами и лекциями, судебными заседаниями, а также видеоконтентом, которому нужны субтитры. Отдельная категория — записи с плохим звуком, несколькими говорящими и профессиональной терминологией, где автоматическое распознавание ошибается чаще всего.
Протокол встречи с указанием, кто что сказал, и тайм-кодами ключевых решений.
Дословная расшифровка для исследований, где важна формулировка респондента.
Текстовая версия обучающего материала для конспектов, статей и поиска по содержанию.
Стенограмма с точной передачей реплик — там, где цена ошибки в формулировке высока.
SRT или VTT с разбивкой по репликам и синхронизацией по времени.
Записи с шумом, эхом, перебиванием и несколькими микрофонами — там, где автомат не справляется.
Сначала мы прогоняем запись через автоматическое распознавание речи — это даёт черновик за минуты. Затем транскрибатор вычитывает текст под звук, исправляет ошибки, размечает спикеров и расставляет тайм-коды. Готовый файл проходит выборочную проверку редактора и передаётся вам в согласованном формате.
Текст передаём в DOCX, TXT или Markdown, субтитры — в SRT и VTT, структурированный транскрипт с тайм-кодами и спикерами — в JSON или CSV под дальнейшую обработку. Формат оформления согласуем заранее: дословный вариант со словами-паразитами или причёсанный текст, читаемый без правок.
Автоматическое распознавание бесплатно и мгновенно, но спотыкается на терминах, именах, перебиваниях и плохом звуке — типичная точность на сложной записи оказывается заметно ниже заявленной. Человек снимает именно эти ошибки: восстанавливает термины, различает говорящих и корректно оформляет реплики. Для черновика хватает автомата, для документа — нет.
Профессиональная лексика, названия компаний и фамилии — там, где автомат ошибается систематически.
Перебивания и наложение реплик автомат склеивает в один поток, человек разделяет.
Шум, эхо, удалённый микрофон — фрагменты переслушиваются, а не выбрасываются.
Пунктуация и абзацы делают текст читаемым, а не сплошным потоком слов.
Редактор независимо сверяет фрагменты готового текста со звуком.
Целевой уровень точности фиксируем в договоре и подтверждаем на приёмке.
Расшифровка считается по минутам записи — от 25 ₽ за минуту. На итог влияют число говорящих, качество звука, наличие терминологии, нужны ли тайм-коды и субтитры, а также срочность. Калькулятор ниже даёт быструю прикидку, точную смету фиксируем после бесплатного пилота на фрагменте вашей записи.
Чаще других заказывают исследователи и маркетологи, которым нужны дословные интервью, юристы и корпоративные секретари, ведущие протоколы, а также образовательные проекты и медиа, превращающие записи в статьи и субтитры. Отдельный запрос — компании, которые собирают из расшифровок обучающую выборку для собственных речевых моделей.
Перевели в текст 60 часов видеоинтервью с респондентами: дословный формат, разметка говорящих и тайм-коды по темам. Автоматический черновик содержал ошибки в терминах и путал говорящих при перебиваниях, после вычитки точность на приёмке составила 99,4%. Показатели — типовой сценарий проекта такого класса, не кейс конкретного клиента.
Транскрипт — это просто текст сказанного. Стенограмма оформляется как документ: с указанием даты и участников, разделением реплик по говорящим, регламентными пометками и, при необходимости, тайм-кодами. Стенограммы обычно нужны для заседаний, советов директоров и судебных записей.
Для разовой задачи подойдут автоматические сервисы и открытые модели вроде Whisper: они дают черновик за минуты и ничего не стоят. Такой текст годится для поиска по содержанию, но требует вычитки, если из него делают протокол, статью или документ.
На чистой записи одного говорящего автомат ошибается редко. На реальных совещаниях с шумом, перебиваниями и профессиональными терминами доля ошибок заметно растёт, поэтому мы всегда используем распознавание как черновик, а финальный текст вычитывает человек.
Да, отдаём субтитры в форматах SRT и VTT с разбивкой по репликам и синхронизацией по времени. Такой файл загружается в видеоплатформу или монтажную программу без дополнительной обработки.
Да, размечаем, кто произносит каждую реплику. Если участники не представляются, обозначаем их как «Спикер 1», «Спикер 2», а при наличии списка участников подставляем имена — это удобно для протоколов и исследований.
Ориентировочно час записи требует нескольких часов работы транскрибатора, поэтому типовой срок для часовой записи — один рабочий день. Срочные задачи берём вне общей очереди, это отражается в стоимости.
NDA подписываем до передачи файлов, доступ к записи получает только работающий над ней специалист, хранение и обработка идут на инфраструктуре в РФ по 152-ФЗ. После сдачи проекта исходные файлы удаляем по вашему запросу.
Расшифруем несколько минут вашего видео бесплатно — вы увидите качество текста и оформление до того, как обсуждать весь объём.
Не любите формы — напишите на info@datamarkup.ru