Resumo: O Subtitle Edit adicionou recentemente o Video OCR (Video → OCR burned-in subtitle…), então esse editor gratuito e de código aberto agora consegue extrair legendas embutidas de um vídeo — um acréscimo realmente útil. A diferença está no motor interno. O Subtitle Edit pede que você desenhe um retângulo de varredura e então roda um mecanismo de OCR de uso geral quadro a quadro (Apple Vision no macOS; Paddle OCR no Windows/Linux; ou modelos de visão para baixar como GLM-OCR e PaddleOCR-VL). O GeekLink, em vez disso, detecta automaticamente as linhas de legenda reais e as reconhece com modelos ajustados especificamente para texto de legenda — o que o torna muito mais rápido e com menor chance de perder uma linha — e vem pronto para rodar, sem nenhum mecanismo de OCR ou modelo para baixar ou instalar. Se você já trabalha no Subtitle Edit e quer OCR gratuito dentro do seu editor, o Video OCR dele é uma boa opção. Se você quer a extração de legendas embutidas mais rápida e sem complicação, é aí que o GeekLink sai na frente.

Quer extrair legendas embutidas sem instalar nada? O GeekLink encontra as linhas de legenda automaticamente e roda o OCR localmente no seu computador — sem mecanismo para escolher nem modelo para baixar. Plano gratuito, sem precisar de conta.

Download Free

O que é o Video OCR do Subtitle Edit?

O Subtitle Edit é um editor de legendas gratuito e de código aberto, de longa data, que recentemente ganhou um recurso de Video OCR que extrai as legendas embutidas (hardcoded) de um vídeo como linhas editáveis. Você abre Video → OCR burned-in subtitle…, encontra um quadro com legenda, ajusta um retângulo de varredura sobre onde ficam as legendas (por padrão, o terço inferior), escolhe um mecanismo de OCR e um idioma, opcionalmente testa o quadro atual e clica em Start OCR. As linhas reconhecidas aparecem em uma lista que você pode editar ali mesmo. Para uma ferramenta que muita gente já usa para ajustar tempos e limpar, ter OCR integrado é uma comodidade de verdade.

O que importa nesta comparação é como ele reconhece o texto. O Subtitle Edit entrega a tarefa a um mecanismo de OCR genérico e, segundo a própria documentação, a escolha depende da sua plataforma:

  • Apple Vision — apenas macOS; local, rápido e sem nada para baixar.
  • Paddle OCR — Windows e Linux; local, baixado automaticamente.
  • Modelos de visão do llama.cpp — GLM-OCR 0.9B, PaddleOCR-VL 1.6 (109 idiomas), HunyuanOCR, LightOnOCR; multiplataforma, mecanismo e modelos baixados automaticamente.
  • Visão com CrispEmbed e Ollama — outros caminhos locais de modelos de visão (o Ollama é instalado à parte), além de uma opção de API GLM na nuvem.

São reconhecedores competentes e de uso geral — as opções de modelos de visão, em especial, são fortes com os caracteres em si e cobrem muitos idiomas. Mas apontam para um retângulo e rodam sobre quadros amostrados; o trabalho específico de legenda — decidir quais linhas são realmente legendas, ignorar logotipos e elementos na tela, e não reler a mesma legenda em cada quadro — fica por sua conta e depende de quão bem você desenhou a caixa.

GeekLink vs Subtitle Edit Video OCR: como se comparam?

Ambos transformam o texto embutido em legendas editáveis. A diferença está nas quatro coisas que o GeekLink constrói especificamente para legendas: detecção automática de linhas, reconhecimento ajustado a legendas, velocidade e zero configuração de modelos.

Recurso GeekLink Subtitle Edit Video OCR
OCR de legendas embutidas → legendas editáveis Sim — recurso principal Sim — recurso integrado mais recente
Encontrar as linhas de legenda Detecção automática de linhas de legenda — encontra cada linha, inclusive a linha de cima menos frequente das legendas de duas linhas Você desenha um retângulo de varredura; um mecanismo genérico aplica OCR aos quadros dentro dele
Modelo de reconhecimento Modelos ajustados de propósito para texto de legenda na tela Mecanismos de uso geral (Apple Vision / Paddle OCR / LLMs de visão)
Download / configuração de modelos Nenhum — vem pronto para rodar, com os modelos já preparados Depende do mecanismo — Paddle OCR e modelos de visão são baixados (alguns grandes); Ollama é instalado à parte; Apple Vision não precisa de nada
Velocidade ~3 min para um vídeo de 30 minutos em 1080p com legendas em inglês num Mac Apple M4 com 16 GB de RAM e ajustes padrão (~10× o tempo real) Varia muito conforme o mecanismo; o Apple Vision é rápido, enquanto os mecanismos de modelos de visão precisos são pesados por quadro (mais lentos sem uma GPU rápida)
Ignorar logotipos, marcas d'água e texto na tela Filtrado automaticamente fora das linhas de legenda Tudo o que cai na caixa de varredura passa por OCR; é preciso reenquadrar para excluir
Plataforma Apps de desktop para Mac e Windows Windows / Linux / macOS (os mecanismos disponíveis variam por sistema)
Preço Plano gratuito para OCR; há planos pagos — consulte os preços atuais na página inicial Gratuito, de código aberto

Ele encontra as linhas de legenda por você

A maior diferença é que o GeekLink trata a extração como um problema de legenda, não como um problema de um retângulo de pixels. O Video OCR do Subtitle Edit pede que você posicione uma caixa de varredura e então reconhece qualquer texto que apareça dentro dela em cada quadro amostrado. Funciona, mas coloca o julgamento sobre você: se a caixa ficar um pouco apertada, a linha de cima menos frequente de uma legenda de duas linhas pode ficar de fora; se ficar folgada demais, o logotipo de um canal, uma marca d'água ou gráficos na tela são lidos como legendas.

O GeekLink detecta primeiro as linhas de legenda reais — antes do reconhecimento — e é construído de propósito para detectar a mais em vez de perder (uma linha que você não quer some com um clique; uma linha que nunca foi capturada é uma perda silenciosa). Ele preserva as linhas de baixa frequência que um recorte fixo tende a descartar e mantém o reconhecimento longe de logotipos e elementos sobrando. Você não precisa ajustar um retângulo para se proteger desses casos; a detecção cuida disso.

Ele reconhece com modelos ajustados a legendas

O reconhecimento do GeekLink é ajustado especificamente para o texto de legenda na tela — aquela tipografia estilizada, com contorno e às vezes pequena, que fica sobre um vídeo em movimento — em vez de um OCR de documentos genérico ou um modelo de visão genérico aplicado a um quadro de vídeo. É desse ajuste que vem a precisão em legendas reais: menos caracteres corrompidos em legendas estilizadas e resultados mais estáveis em texto CJK denso.

Os mecanismos do Subtitle Edit são de uso geral por concepção. O Apple Vision é rápido e não precisa de download, mas é um OCR de sistema genérico e pode ter dificuldade com legendas estilizadas ou CJK pequenas. Os mecanismos de modelos de visão (GLM-OCR, PaddleOCR-VL e companhia) são reconhecedores realmente fortes e cobrem muitos idiomas — mas são modelos genéricos que você aponta para um quadro, não um fluxo específico de legendas e, como observado abaixo, são as opções pesadas do tipo 'baixar primeiro'.

É muito mais rápido

Num Mac Apple M4 com 16 GB de RAM, o GeekLink extrai um vídeo de 30 minutos em 1080p com legendas embutidas em inglês em cerca de 3 minutos com os ajustes padrão — aproximadamente 10× o tempo real. Parte disso é não refazer trabalho: uma legenda permanece na tela por muitos quadros consecutivos, então reconhecer cada quadro amostrado de forma independente repete a mesma leitura várias vezes. O GeekLink combina as evidências de uma mesma legenda e pula os quadros em que nada mudou, de modo que o reconhecimento caro roda muito menos vezes.

O Subtitle Edit não publica um número de desempenho e, honestamente, isso varia muito conforme o mecanismo. O Apple Vision é rápido. Mas as opções precisas — os modelos de visão do llama.cpp, CrispEmbed, Ollama — são LLMs de visão pesados que rodam por quadro, o que pode ser lento, especialmente sem uma GPU rápida. Então, no Subtitle Edit, você muitas vezes troca velocidade por precisão no momento de escolher o mecanismo; o GeekLink busca oferecer ao mesmo tempo o caminho da precisão ajustada e o caminho rápido.

Nada para baixar ou instalar

O GeekLink vem pronto para rodar. Não há mecanismo de OCR para escolher nem modelo para buscar antes de começar: abra o app, aponte para o vídeo e vá. Os modelos de reconhecimento já estão preparados para você.

Com o Video OCR do Subtitle Edit, a preparação dos modelos depende do mecanismo que você escolher. O Paddle OCR baixa automaticamente no Windows e no Linux; os mecanismos de modelos de visão baixam um mecanismo mais um modelo (alguns grandes); o Ollama é uma instalação à parte que você mesmo gerencia. No macOS, o Apple Vision é o único caminho que não precisa de nada — mas também é o reconhecedor mais genérico, então em legendas mais difíceis, estilizadas ou CJK você é empurrado para os modelos de visão do tipo 'baixar primeiro' para melhorar a qualidade. O GeekLink evita essa bifurcação por completo: um único caminho, ajustado, sem nada para baixar.

Quando o Subtitle Edit é a melhor escolha?

Muitas vezes. O Subtitle Edit é um editor de legendas excelente, gratuito e de código aberto, e o seu OCR é um trunfo de verdade:

Você já edita no Subtitle Edit. Se as suas legendas já vivem no Subtitle Edit para ajuste de tempo e limpeza, fazer o OCR na mesma janela — e editar ali mesmo as linhas reconhecidas — é prático e não custa nada.

Você quer gratuito e de código aberto, ponto final. O Subtitle Edit é gratuito e aberto. Se preço e abertura pesam mais que velocidade e instalação sem complicação, é uma ótima resposta.

Você quer escolher um mecanismo de OCR específico. O Subtitle Edit deixa você escolher entre vários mecanismos e trocar por um modelo de visão específico (ou um mecanismo na nuvem) se tiver um motivo para preferi-lo.

Os dois também não se excluem: um padrão comum é fazer a extração rápida e sem complicação no GeekLink e levar o resultado ao Subtitle Edit para o ajuste fino de tempos. Ferramentas diferentes, forças diferentes.

Perguntas frequentes

O Subtitle Edit tem OCR para legendas embutidas?

Sim. O Subtitle Edit adicionou recentemente um recurso de Video OCR (Video → OCR burned-in subtitle…) que extrai as legendas embutidas de um vídeo como linhas editáveis. Você desenha um retângulo de varredura, escolhe um mecanismo de OCR e um idioma, e inicia o OCR. O GeekLink faz o mesmo trabalho, mas detecta as linhas de legenda automaticamente e usa modelos ajustados a legendas, então não há retângulo para ajustar nem mecanismo ou modelo para baixar.

Qual é mais rápido no OCR, GeekLink ou Subtitle Edit?

Depende do mecanismo do Subtitle Edit. O Apple Vision é rápido; os mecanismos de modelos de visão mais precisos (llama.cpp com GLM-OCR ou PaddleOCR-VL, CrispEmbed, Ollama) são pesados por quadro e podem ser lentos sem uma GPU rápida. O GeekLink extrai um vídeo de 30 minutos em 1080p com legendas em inglês em cerca de 3 minutos num Mac Apple M4 com 16 GB de RAM (cerca de 10x o tempo real), em parte por combinar quadros repetidos e pular os que não mudam em vez de reler cada quadro.

Preciso baixar modelos para usar o Video OCR do Subtitle Edit?

Para a maioria dos mecanismos, sim. O Paddle OCR baixa automaticamente no Windows e no Linux, e os mecanismos de modelos de visão baixam um mecanismo mais um modelo (alguns grandes); o Ollama é instalado à parte. No macOS, o Apple Vision não precisa de download, mas é um reconhecedor genérico. O GeekLink vem com os modelos de reconhecimento preparados, então não há nada para escolher ou baixar antes de começar.

Por que o GeekLink perde menos linhas de legenda?

O Subtitle Edit aplica OCR a qualquer texto que caia dentro do retângulo de varredura que você desenha, então um recorte um pouco apertado pode descartar a linha de cima menos frequente de uma legenda de duas linhas, e um recorte folgado pode captar logotipos ou texto na tela. O GeekLink detecta as linhas de legenda automaticamente e é feito para detectar a mais em vez de perder — você apaga uma linha indesejada com um clique, mas uma linha nunca é perdida em silêncio — e mantém o reconhecimento longe de marcas d'água e elementos sobrando.

O Video OCR do Subtitle Edit é preciso?

Pode ser, especialmente os mecanismos de modelos de visão, que são reconhecedores genéricos fortes em muitos idiomas. As contrapartidas são que a opção rápida (Apple Vision) é um OCR genérico que pode ter dificuldade com legendas estilizadas ou CJK pequenas, enquanto as opções precisas são downloads pesados que rodam por quadro. O GeekLink usa modelos ajustados especificamente para o texto de legenda na tela, buscando essa precisão sem a penalidade de velocidade ou instalação.

Posso usar os dois juntos?

Sim. Um padrão comum é extrair as legendas embutidas rapidamente no GeekLink sem instalar nada e depois abrir o resultado no Subtitle Edit para o ajuste fino de tempos e a limpeza. Eles se complementam — o GeekLink para uma extração rápida e sem complicação; o Subtitle Edit para um ambiente de edição gratuito e profundo.

Artigos relacionados