Respuesta corta: el OCR de Subtitle Edit lee pistas de subtítulos basadas en imagen —VobSub de DVDs, PGS de Blu-rays, y las mismas pistas multiplexadas dentro de archivos MKV. No lee el texto que ha sido quemado en la propia imagen del video. Si tu MP4 muestra subtítulos que no puedes desactivar, no hay ninguna pista de subtítulos en el archivo que Subtitle Edit pueda importar, así que sus herramientas de OCR nunca llegan a ejecutarse. Extraer ese texto requiere un tipo de herramienta distinto —una que escanee los fotogramas del video— y esta guía cubre exactamente qué herramientas hacen eso.

Esta pregunta surge constantemente en la comunidad de Subtitle Edit: alguien tiene un .mp4 con subtítulos visiblemente en pantalla, recuerda un menú de "Importar/OCR subtítulos" y no logra entender por qué no pasa nada. La confusión es comprensible, porque ambas funciones se llaman OCR, pero resuelven dos problemas muy distintos. Vamos a separarlos.

¿Qué hace realmente el OCR de Subtitle Edit?

Los DVDs y Blu-rays no almacenan los subtítulos como texto. Los almacenan como imágenes: cada línea de subtítulo es una pequeña imagen con una marca de tiempo, ubicada en su propia pista junto a los flujos de video y audio. Los subtítulos de DVD usan el formato VobSub (.sub/.idx), los Blu-rays usan PGS (.sup), y ambos pueden multiplexarse en un contenedor MKV cuando ripeas un disco.

Como esas imágenes viven en una pista separada, Subtitle Edit puede recorrerlas una a una, ejecutar OCR sobre cada imagen y entregarte texto editable con la sincronización original preservada. Para eso sirve la ventana de OCR de Subtitle Edit, y es realmente buena en ello: admite varios motores de OCR y preserva la sincronización original de cada subtítulo.

El punto clave: en cada uno de esos casos, ya existe una pista de subtítulos dentro del archivo. El OCR de Subtitle Edit convierte un formato de subtítulo (imágenes) en otro (texto). Nunca mira los fotogramas de la película en sí.

¿Adónde fue el menú "Importar/OCR subtítulos desde video"?

Si recuerdas una opción de Importar/OCR y no la encuentras o no logras que funcione, esto es lo que hacía en realidad: buscaba dentro del contenedor de video una pista de subtítulos basada en imagen —por ejemplo, una pista PGS dentro de un MKV— y la abría para OCR. Leía la lista de pistas del contenedor, no la imagen.

Ejecútalo en un .mp4 típico con subtítulos quemados y no encuentra nada, porque no hay nada que encontrar: el archivo contiene un flujo de video, un flujo de audio, y ninguna pista de subtítulos en absoluto. El texto que ves en pantalla ya no es un subtítulo en ningún sentido técnico: es parte de la imagen, igual que una cara o una lámpara en el fondo.

Los subtítulos quemados (incrustados) son un problema distinto

Cuando los subtítulos están quemados —también llamados hardcoded— el texto se renderizó sobre los fotogramas en el momento de la codificación. Quien produjo el archivo fusionó los subtítulos en la imagen de forma permanente. Eso tiene tres consecuencias:

  • No hay pista que importar. Las herramientas de contenedor (Subtitle Edit, ffmpeg, MKVToolNix) informan todas lo mismo: este archivo no tiene subtítulos.
  • No hay forma de desactivarlos. Los reproductores solo pueden alternar pistas; aquí no hay ninguna pista.
  • La extracción se convierte en un problema de análisis de video. Para recuperar el texto, una herramienta tiene que escanear los fotogramas reales: detectar cuándo aparece y desaparece una línea (eso se convierte en tu sincronización), reconocer que cientos de fotogramas casi idénticos muestran la misma línea (para que obtengas un subtítulo, no trescientos duplicados) y separar el texto de lo que sea que se mueva detrás de él.

Ese pipeline de escaneo de fotogramas es un trabajo fundamentalmente distinto al de decodificar una pista de imagen bien empaquetada, por lo que Subtitle Edit —un editor de archivos de subtítulos— no lo hace, y por eso "OCR" significa algo distinto en cada contexto. Esto no es especulación: el propio equipo de Subtitle Edit ha dicho en GitHub que "la detección y extracción de hardsubs no es una tarea sencilla, así que no se implementará en SE", y una solicitud de función para OCR de fotogramas de video se cerró como wontfix.

Cómo saber qué tipo de subtítulos tiene tu video

Una comprobación de diez segundos en cualquier reproductor que muestre pistas de subtítulos (VLC, IINA, mpv):

  1. Abre el video y mira el menú de pistas de subtítulos (en VLC: Subtítulo → Pista de subtítulos).
  2. Si aparece una pista y puedes desactivarla, tus subtítulos son una pista real: subtítulos incrustados y activables. Subtitle Edit normalmente puede extraerlos directamente, y si son basados en imagen, su OCR los maneja.
  3. Si el menú está vacío pero los subtítulos siguen en pantalla, están quemados. Ninguna herramienta de contenedor ayudará; necesitas OCR de fotogramas.

Esta única comprobación ahorra mucho esfuerzo desperdiciado, porque las dos situaciones se ven idénticas al mirar pero necesitan herramientas completamente distintas.

¿Qué extrae realmente los subtítulos incrustados?

Una vez que sabes que el texto está quemado, estas son las opciones realistas:

HerramientaPlataformaPrecioFlujo de trabajo
VideoSubFinder Windows Gratis Varios pasos: detectar fotogramas con texto, exportar imágenes, aplicarles OCR por separado, reconstruir la sincronización
videocr / VideOCR Windows, Linux Gratis, código abierto Línea de comandos o una GUI sencilla; una sola herramienta, algo de configuración
GeekLink macOS (Apple Silicon) Plan gratuito Una sola pasada: suelta el video, selecciona el área de subtítulos, exporta SRT con sincronización

Las tres leen los fotogramas del video en lugar del contenedor, que es la capacidad que le falta a Subtitle Edit. Cuál te conviene depende sobre todo de tu plataforma y de cuánto trabajo manual toleres:

  • VideoSubFinder es el flujo de trabajo veterano de Windows. Funciona, pero montas el pipeline tú mismo: la detección de fotogramas, el OCR de imágenes y la reconstrucción de la sincronización son etapas separadas.
  • videocr / VideOCR envuelve el OCR de fotogramas en una sola herramienta de código abierto con compilaciones oficiales para Windows y Linux.
  • GeekLink es una app nativa de Mac que ejecuta todo el pipeline en una sola pasada, enteramente en tu máquina: escanea el video, aplica OCR al texto quemado y exporta un SRT limpio. También procesa varios videos por lotes y puede traducir los subtítulos extraídos en la misma pasada. Mira la guía paso a paso en Cómo extraer subtítulos incrustados usando OCR.

El flujo de trabajo que mejor combina con Subtitle Edit

Nada de esto hace que Subtitle Edit sea menos útil: simplemente ocupa una etapa distinta del pipeline. El flujo de trabajo que funciona bien en la práctica:

  1. Extraer: ejecuta una herramienta de OCR de fotogramas sobre el video con subtítulos quemados y exporta un SRT.
  2. Pulir: abre ese SRT en tu editor preferido —Subtitle Edit incluido— para corregir fallos de reconocimiento, ajustar la sincronización y reformatear. La salida es un archivo SRT estándar, así que se abre en cualquier editor de subtítulos.
  3. Entregar: conserva el SRT como una pista de subtítulos activable, tradúcelo, o quémalo de vuelta en un nuevo video con un estilo diferente.

¿Prefieres quedarte dentro de Subtitle Edit? El flujo de trabajo que su comunidad recomienda es ejecutar primero VideoSubFinder para detectar los fotogramas con texto, y luego cargar esas imágenes en Subtitle Edit mediante Archivo > Importar > Imágenes y aplicarles OCR ahí. Funciona, pero una herramienta separada de detección de fotogramas sigue haciendo el análisis del video: Subtitle Edit solo toma el relevo una vez que los fotogramas están extraídos.

Sea cual sea el extractor que uses, cuenta con una pasada de corrección. La precisión del OCR sobre texto quemado depende mucho de la fuente, del contraste entre el texto y el fondo, y de cuánto movimiento hay detrás de la línea de subtítulo. La meta realista es un borrador sólido que necesita una limpieza ligera, no un archivo perfecto recién salido de la herramienta.

Divulgación: GeekLink es nuestro producto. Hemos intentado mantener esta guía objetiva y justa: Subtitle Edit es un editor excelente, y la limitación descrita aquí es una decisión de diseño que su propio equipo ha confirmado, no un defecto. Usa la herramienta de extracción que se ajuste a tu plataforma, y sigue editando allí donde te sientas más cómodo.

Preguntas frecuentes

¿Puede Subtitle Edit extraer subtítulos incrustados de un video?

No. El OCR de Subtitle Edit funciona con pistas de subtítulos basadas en imagen (VobSub, PGS de Blu-ray e imágenes dentro de archivos MKV), no con texto quemado en la imagen del video. Para los subtítulos quemados necesitas una herramienta de OCR de fotogramas como VideoSubFinder, videocr/VideOCR o GeekLink en Mac.

¿Qué formatos de subtítulos puede hacer OCR Subtitle Edit?

VobSub de DVD (.sub/.idx), PGS de Blu-ray (.sup), y las mismas pistas basadas en imagen cuando están multiplexadas dentro de un contenedor como MKV. En todos estos, los subtítulos existen como imágenes en su propia pista, que es lo que la ventana de OCR de Subtitle Edit convierte en texto.

¿Por qué la opción de Importar/OCR no funciona en mi MP4?

Porque esa función importa pistas de subtítulos de imagen desde dentro del contenedor, y un MP4 típico con subtítulos quemados no tiene ninguna pista de subtítulos: el texto es parte de los píxeles del video. Desde el punto de vista de Subtitle Edit, el archivo simplemente no contiene subtítulos.

¿Cómo extraigo subtítulos incrustados en un Mac?

GeekLink es una app nativa de Mac creada exactamente para esto: escanea los fotogramas del video, aplica OCR al texto quemado y exporta un SRT estándar con sincronización, enteramente sin conexión. VideoSubFinder es software de Windows, así que en un Mac las alternativas prácticas son ejecutarlo en un entorno de Windows o usar una herramienta de línea de comandos basada en Python.

¿Qué tan preciso es el OCR sobre subtítulos quemados?

Depende de la fuente: las fuentes limpias sobre fondos de alto contraste se reconocen muy bien, mientras que las fuentes estilizadas, el bajo contraste y los fondos en movimiento cargados provocan más errores. Sea cual sea la herramienta que uses, cuenta con corregir el resultado: la meta es un borrador sólido, no un archivo perfecto.

¿Puedo editar el SRT extraído en Subtitle Edit después?

Sí. Las herramientas de OCR de fotogramas exportan archivos SRT estándar, que se abren en cualquier editor de subtítulos, incluido Subtitle Edit. Extrae primero con una herramienta de OCR de fotogramas y luego pule la sincronización y el texto en el editor que ya conoces.

Artículos relacionados