Legendas de OCR Saíram Ilegíveis? Como Corrigir

Por Flora Wang, especialista em localização de vídeo · Publicado em 25 de julho de 2026 · 7 min de leitura

Resumo: um OCR ilegível é quase sempre um problema de entrada, não um problema de configuração. As quatro coisas que arruínam o OCR de legendas são uma fonte de baixa resolução, uma região de OCR que captura mais do que a linha de legenda, um fundo carregado atrás do texto, e o idioma de reconhecimento errado — corrija essas e a precisão dispara. Quando a fonte é simplesmente de qualidade muito baixa, nenhum OCR consegue perfeição, e uma passada rápida em um editor é mais rápida do que brigar com as configurações.

Por que meu OCR saiu ilegível?

O OCR de legendas não lê um "arquivo" de legenda — não existe nenhum. Ele lê imagens de texto, quadro a quadro, e transforma as formas que vê em caracteres. Então a qualidade do resultado depende inteiramente de quão claras são essas imagens. Se a imagem está borrada, poluída, ou em um idioma que o leitor não foi instruído a esperar, a leitura sai errada, e você recebe caracteres incorretos, letras faltando, ou linhas que parecem sem sentido.

Essa é a mudança de mentalidade chave: quando o resultado sai ilegível, o conserto quase nunca é um controle de precisão escondido. É uma de quatro coisas relacionadas à entrada. Na prática, um OCR de legendas ruim tem origem em uma fonte de baixa resolução ou fortemente comprimida, uma região de OCR que captura mais do que a linha de legenda, um fundo carregado ou de alto contraste atrás do texto, ou o idioma de reconhecimento errado. O restante deste guia trata de cada um deles, em ordem.

Um OCR de legendas ilegível é um problema de entrada: imagens borradas, regiões poluídas, fundos que distraem, ou um idioma inesperado — não uma configuração quebrada para ativar.

Fonte de baixa resolução ou fortemente comprimida

Essa é a causa número um de leituras erradas. Quando o vídeo é de baixa resolução ou foi recomprimido de forma agressiva, as letras perdem suas bordas — elas ficam borradas e quadriculadas, e o OCR simplesmente não consegue distinguir um "m" de um "rn", ou um caractere chinês de outro parecido. Nenhum ajuste torna um texto borrado nítido novamente.

O conserto é fornecer ao OCR a imagem mais limpa que você tiver. Use sempre a cópia de maior resolução do vídeo que você conseguir: uma fonte em 1080p passa pelo OCR muito melhor do que um reupload comprimido em 480p do mesmo clipe. Se você tiver a opção entre um arquivo pequeno baixado de um aplicativo de chat e o original, use o original. E se a única fonte que você tem é genuinamente de baixa resolução, ajuste suas expectativas — você vai ter alguns erros de qualquer forma, e o plano deve ser corrigi-los depois em vez de perseguir uma execução perfeita.

Texto borrado e quadriculado é a maior causa isolada de OCR ilegível; comece pela cópia de maior resolução que você tiver, porque uma fonte em 1080p é lida muito melhor do que uma comprimida em 480p.

A região de OCR está capturando mais do que a legenda

Se a área que você entrega ao OCR inclui mais do que a linha de legenda — um logotipo de canal, uma marca d'água no canto, legendas na tela, um placar, ou créditos embutidos — todo esse texto também é lido, e acaba misturado nas suas linhas de legenda como lixo. A legenda em si pode ser lida perfeitamente, mas o resultado parece quebrado porque está grudado a um texto que nunca fez parte do diálogo.

O conserto é desenhar a região de OCR bem justa ao redor apenas da linha de legenda, geralmente uma faixa estreita na parte inferior do quadro, e nada mais. O GeekLink permite definir essa região manualmente, e também filtrar por cor, tamanho de fonte e idioma, de modo que apenas a legenda seja lida e logotipos ou legendas na tela sejam deixados de fora. Uma região justa é a melhoria isolada mais rápida que você pode fazer quando a fonte em si está boa mas o resultado ainda sai bagunçado.

Se a região de OCR sobrepõe logotipos ou texto na tela, isso é lido como lixo nas suas linhas — desenhe a região justamente ao redor apenas da legenda para corrigir.

Fundo carregado ou de alto contraste atrás do texto

Legendas ficam sobrepostas às imagens, e quando essas imagens são claras, detalhadas ou em movimento rápido, as letras podem se misturar com o que está atrás delas. Uma legenda branca sobre uma cena de neve, ou sobre realces brilhantes em movimento, é genuinamente difícil de ler — as bordas dos caracteres desaparecem no fundo e são lidas incorretamente.

Ler o texto ao longo de muitos quadros ajuda nesse caso, porque a mesma linha de legenda permanece na tela enquanto a imagem atrás dela muda: alguns quadros têm um trecho mais limpo e escuro atrás exatamente das mesmas palavras, e esses quadros são lidos corretamente. Uma região bem desenhada e o idioma de reconhecimento correto também ajudam o leitor a se fixar nas letras em vez do cenário. Dito isso, seja realista: legendas com contraste muito baixo contra o fundo continuam sendo o caso mais difícil, e algumas linhas ainda podem precisar de correção manual.

Imagens claras e carregadas atrás do texto fazem as letras se misturarem e serem lidas incorretamente; ler a linha ao longo dos quadros captura os momentos mais limpos, mas legendas de contraste muito baixo continuam sendo o caso mais difícil.

Idioma de reconhecimento errado

O OCR lê muito melhor quando sabe qual idioma esperar, porque usa a forma dos caracteres desse idioma para decidir o que está vendo. Se o OCR está configurado para inglês mas a legenda é em chinês, japonês ou coreano — ou o inverso — o resultado é sem sentido desde o primeiro caractere, porque o leitor está tentando corresponder ao alfabeto errado.

O conserto leva dez segundos: defina o idioma de reconhecimento para corresponder à legenda antes de executar. Se um vídeo tem dois idiomas na tela (por exemplo, uma legenda bilíngue), escolha aquele que você realmente quer extrair, ou execute no idioma que mais importa para o seu trabalho. Acertar isso primeiro muitas vezes transforma um resultado completamente ilegível em um resultado limpo, então vale a pena verificar antes de culpar qualquer outra coisa.

Se o idioma de reconhecimento não corresponde à legenda, o resultado é sem sentido — defina o idioma como o idioma da legenda antes de executar, e verifique isso primeiro.

Quando o OCR ainda não é perfeito

Vale a pena ser honesto sobre o teto: nenhum OCR é 100% preciso em fontes difíceis. Em um vídeo limpo, de alta resolução e com fundo simples, ele chega bem perto, mas um download comprimido com imagens carregadas e fontes estilizadas sempre vai deixar algumas leituras erradas. Perseguir a perfeição executando novamente com configurações ligeiramente diferentes geralmente é o caminho mais lento.

O caminho rápido é a ordem oposta: corrija a entrada onde puder — a melhor resolução disponível, uma região justa, o idioma correto — e depois corrija o punhado de leituras erradas restantes em um editor em vez de executar novamente. No Mac, o GeekLink roda o OCR localmente na sua máquina, permite definir a região e o idioma de reconhecimento, e depois permite corrigir qualquer linha lida errado no editor integrado antes de exportar o SRT. Você percorre as linhas, corrige as poucas que estão erradas, e exporta uma vez — o que quase sempre é mais rápido do que procurar uma combinação de configurações que leia perfeitamente uma fonte difícil.

Nenhum OCR é perfeito em fontes difíceis, então corrija a entrada primeiro, depois corrija as leituras erradas restantes em um editor em vez de executar novamente com configurações diferentes.

Perguntas frequentes

Por que meu OCR está cheio de caracteres errados?

Geralmente uma fonte de baixa resolução ou o idioma de reconhecimento errado; verifique os dois primeiro. Texto borrado e quadriculado de um vídeo comprimido é a causa mais comum, e uma incompatibilidade de idioma transforma texto legível em algo sem sentido desde o início. Comece com a cópia de maior resolução que você tiver e confirme que o idioma de reconhecimento corresponde à legenda.

O OCR misturou a legenda com texto na tela — como faço para impedir isso?

Desenhe a região de OCR bem justa ao redor apenas da linha de legenda, e filtre por cor ou região para que logotipos e legendas na tela sejam ignorados. Quando a área selecionada inclui marcas d'água, logotipos de canal, ou legendas na tela, esse texto é lido junto nas suas linhas de legenda. Uma região estreita na parte inferior do quadro, mais filtros de cor e idioma, mantém apenas a legenda.

O resultado do meu OCR está no idioma errado / totalmente sem sentido.

O idioma de reconhecimento não corresponde à legenda; defina-o como o idioma da legenda e execute novamente. Se o OCR espera inglês mas a legenda é em chinês, japonês ou coreano (ou o inverso), todo caractere sai errado. Definir o idioma correto antes de executar geralmente corrige um resultado completamente ilegível em uma única etapa.

O OCR de legendas pode ser 100% preciso?

Não — em fontes limpas e de alta resolução ele é muito bom, mas fontes difíceis sempre precisam de uma rápida verificação humana. Downloads comprimidos, fundos carregados e fontes estilizadas deixarão algumas leituras erradas. O fluxo de trabalho mais rápido é corrigir a entrada, e depois corrigir as linhas restantes em um editor antes de exportar.

Como aplico OCR em um vídeo de baixa qualidade?

Use a melhor cópia que você conseguir encontrar, defina uma região justa e o idioma correto, e depois corrija os erros restantes em um editor. Uma fonte de baixa resolução ou fortemente comprimida nunca vai passar por OCR perfeitamente, então mire na imagem mais limpa disponível, estreite a região para apenas a legenda, corresponda o idioma de reconhecimento, e planeje corrigir algumas linhas manualmente depois.

Artigos relacionados

Corrija o OCR ilegível da forma rápida

O GeekLink lê legendas localmente no seu Mac, permite definir a região e o idioma, e permite corrigir leituras erradas no editor antes de exportar o SRT.

Free Download