Как преобразовать SUP и PGS в SRT через распознавание субтитров
В графической дорожке слова сохранены как изображения. Чтобы получить редактируемый текст, их нужно распознать и сверить с оригинальными картинками. Простая смена расширения эту задачу не решает.
Почему нужен OCR, а не обычная конвертация
Текстовый файл хранит символы, с которыми можно работать в редакторе. Графические субтитры передают изображение надписи. Для получения слов из такой картинки нужен OCR — оптическое распознавание символов.
Определите, что требуется сохранить: текст существующего перевода или звучащую речь. Эти источники могут различаться. Распознавание надписей воспроизводит видимые слова; транскрибация аудио ориентируется на голос.
Не запускайте оба процесса без цели. Если нужна именно готовая переводная дорожка, новый текст по аудио может оказаться на другом языке или содержать другую редакцию. Сначала выберите источник, который должен отражать результат.
Подготовьте графическую дорожку
Сохраните исходный SUP и видео отдельно от будущего SRT. Если дорожка находится внутри MKV, сначала определите её язык и назначение. В одном контейнере могут быть полный диалог и короткая дорожка только для отдельных сцен.
При необходимости используйте руководство по извлечению субтитров из MKV. Получение SUP на этом этапе нормально: это ещё не распознанный текст.
До обработки проверьте несколько изображений: начало, середину, длинную строку и фрагмент с курсивом. Если язык или содержание не те, исправьте выбор дорожки до запуска всей работы. Это дешевле, чем вычитывать ненужный вариант.
Запустите распознавание в Subtitle Edit
В актуальной документации путь к импорту обозначен как File → Import → Image-based subtitle for OCR. Поддерживаются, в частности, Blu-ray SUP и встроенные графические дорожки Matroska.
Выберите доступный OCR-движок и проверьте язык. Для Tesseract используются языковые пакеты; nOCR позволяет работать с обучаемой базой символов. Названия и доступность движков зависят от среды и версии программы.
Запустите Start OCR, просмотрите результаты и исправьте ошибки. После подтверждения OK распознанный текст переносится в редактор субтитров. Не принимайте завершение индикатора за подтверждение точности.
Для вычитки в программе также предусмотрено сохранение изображений с HTML-индексом. Это позволяет сопоставлять исходные картинки и полученные слова. Такой комплект полезен, если проверку продолжает другой редактор.
Вычитайте символы, числа и имена
Просматривайте результат рядом с изображением, а не только отдельным текстом. Особенно внимательно проверяйте короткие слова, имена, отрицания и числа. Ошибка в одном символе может изменить смысл целой фразы.
В учебном примере надпись «Зал 10» после распознавания стала «Зал IO». По грамматике строка может не выглядеть подозрительно, но адресат уже не получит правильный номер. Исправление нужно подтвердить оригинальной картинкой.
Не применяйте массовую замену похожих символов ко всему файлу без проверки. Буква O и цифра 0 могут обе встречаться в материале. Сначала соберите типичные ошибки, затем оценивайте каждое правило на конкретных строках.
Если одна и та же гарнитура распознаётся плохо, проверьте настройки на небольшом фрагменте. Сравните несколько сложных строк до повторной обработки всей дорожки. Сохраните предыдущий результат, чтобы оценить, стало ли лучше.
Сохраните текст и проверьте интервалы
После вычитки сохраните результат как SubRip/SRT с подходящей кодировкой. Откройте именно сохранённый файл и подключите его к исходному видео. Убедитесь, что отображается новая текстовая версия.
Проверьте первую и последнюю реплики, несколько длинных строк и места с одновременными надписями. Сравните не только буквы, но и полноту: пустая строка после неудачного OCR может выглядеть как обычная пауза.
Оцените порядок чтения. Надписи, расположенные в разных частях кадра, после перехода в простой текст могут потерять связь с объектами. При необходимости подготовьте понятную текстовую редакцию, сохранив исходные изображения для сверки.
Не сдвигайте время только из-за того, что строка читается неудобно. Сначала установите причину: неправильный монтаж, слишком длинный текст или ошибка распознавания требуют разных исправлений.
Что делать, если надписи уже вшиты в кадр
Описанный импорт рассчитан на графическую дорожку субтитров. Если текст является частью всего изображения видео, отдельного SUP может не быть. Тогда сначала нужен процесс выделения надписей из кадров, а не импорт несуществующей дорожки.
Если цель — получить произнесённые слова, используйте расшифровку видео. Если цель — сохранить именно надписи, работайте с изображением и учитывайте, что они могут отличаться от речи.
Перед передачей подпишите источник результата: распознавание графических субтитров или расшифровка аудио. Это объяснит получателю, почему текст совпадает с переводом на экране либо с голосом, и поможет проверять спорные места по правильному оригиналу.
Какие ошибки искать после OCR
Иллюстративные примеры проверки, а не результаты измерения точности конкретного движка.
| На изображении | Ошибка в тексте | Как проверить |
|---|---|---|
| Зал 10 | Зал IO | Сверить буквы и цифры |
| Короткое отрицание | Пропущенное слово | Прочитать всю фразу |
| Имя собственное | Похожее обычное слово | Сравнить с картинкой |
| Две надписи | Неверный порядок | Посмотреть расположение в кадре |
| Длинная строка | Пустой результат | Проверить полноту дорожки |
Чек-лист SUP/PGS → SRT
[ ] Выбрана нужная языковая дорожка [ ] Исходные изображения сохранены [ ] Язык OCR проверен [ ] Имена и числа вычитаны [ ] Пустые строки расследованы [ ] SRT открыт после сохранения [ ] Результат проверен с видео
Частые вопросы
Можно переименовать SUP в SRT?
Нет. Изображения не станут текстом после изменения имени. Нужны распознавание и вычитка.
OCR распознаёт звук?
Нет. В этом процессе распознаются символы на изображениях субтитров. Для речи нужен другой процесс.
Почему слов меньше, чем в аудио?
Готовая дорожка может быть сокращённым переводом или содержать только отдельные сцены. Проверьте её назначение.
Нужно ли проверять файл после успешного OCR?
Да. Проверяйте символы, полноту, порядок надписей и соответствие исходному видео.