Resumo: O Subtitle Edit adicionou recentemente o Video OCR (Video → OCR burned-in subtitle…), então esse editor gratuito e de código aberto agora consegue extrair legendas embutidas de um vídeo — um acréscimo realmente útil. A diferença está no motor interno. O Subtitle Edit pede que você desenhe um retângulo de varredura e então roda um mecanismo de OCR de uso geral quadro a quadro (Apple Vision no macOS; Paddle OCR no Windows/Linux; ou modelos de visão para baixar como GLM-OCR e PaddleOCR-VL). O GeekLink, em vez disso, detecta automaticamente as linhas de legenda reais e as reconhece com modelos ajustados especificamente para texto de legenda — o que o torna muito mais rápido e com menor chance de perder uma linha — e vem pronto para rodar, sem nenhum mecanismo de OCR ou modelo para baixar ou instalar. Se você já trabalha no Subtitle Edit e quer OCR gratuito dentro do seu editor, o Video OCR dele é uma boa opção. Se você quer a extração de legendas embutidas mais rápida e sem complicação, é aí que o GeekLink sai na frente.
Quer extrair legendas embutidas sem instalar nada? O GeekLink encontra as linhas de legenda automaticamente e roda o OCR localmente no seu computador — sem mecanismo para escolher nem modelo para baixar. Plano gratuito, sem precisar de conta.
Download FreeO que é o Video OCR do Subtitle Edit?
O Subtitle Edit é um editor de legendas gratuito e de código aberto, de longa data, que recentemente ganhou um recurso de Video OCR que extrai as legendas embutidas (hardcoded) de um vídeo como linhas editáveis. Você abre Video → OCR burned-in subtitle…, encontra um quadro com legenda, ajusta um retângulo de varredura sobre onde ficam as legendas (por padrão, o terço inferior), escolhe um mecanismo de OCR e um idioma, opcionalmente testa o quadro atual e clica em Start OCR. As linhas reconhecidas aparecem em uma lista que você pode editar ali mesmo. Para uma ferramenta que muita gente já usa para ajustar tempos e limpar, ter OCR integrado é uma comodidade de verdade.
O que importa nesta comparação é como ele reconhece o texto. O Subtitle Edit entrega a tarefa a um mecanismo de OCR genérico e, segundo a própria documentação, a escolha depende da sua plataforma:
- Apple Vision — apenas macOS; local, rápido e sem nada para baixar.
- Paddle OCR — Windows e Linux; local, baixado automaticamente.
- Modelos de visão do llama.cpp — GLM-OCR 0.9B, PaddleOCR-VL 1.6 (109 idiomas), HunyuanOCR, LightOnOCR; multiplataforma, mecanismo e modelos baixados automaticamente.
- Visão com CrispEmbed e Ollama — outros caminhos locais de modelos de visão (o Ollama é instalado à parte), além de uma opção de API GLM na nuvem.
São reconhecedores competentes e de uso geral — as opções de modelos de visão, em especial, são fortes com os caracteres em si e cobrem muitos idiomas. Mas apontam para um retângulo e rodam sobre quadros amostrados; o trabalho específico de legenda — decidir quais linhas são realmente legendas, ignorar logotipos e elementos na tela, e não reler a mesma legenda em cada quadro — fica por sua conta e depende de quão bem você desenhou a caixa.
GeekLink vs Subtitle Edit Video OCR: como se comparam?
Ambos transformam o texto embutido em legendas editáveis. A diferença está nas quatro coisas que o GeekLink constrói especificamente para legendas: detecção automática de linhas, reconhecimento ajustado a legendas, velocidade e zero configuração de modelos.
| Recurso | GeekLink | Subtitle Edit Video OCR |
|---|---|---|
| OCR de legendas embutidas → legendas editáveis | Sim — recurso principal | Sim — recurso integrado mais recente |
| Encontrar as linhas de legenda | Detecção automática de linhas de legenda — encontra cada linha, inclusive a linha de cima menos frequente das legendas de duas linhas | Você desenha um retângulo de varredura; um mecanismo genérico aplica OCR aos quadros dentro dele |
| Modelo de reconhecimento | Modelos ajustados de propósito para texto de legenda na tela | Mecanismos de uso geral (Apple Vision / Paddle OCR / LLMs de visão) |
| Download / configuração de modelos | Nenhum — vem pronto para rodar, com os modelos já preparados | Depende do mecanismo — Paddle OCR e modelos de visão são baixados (alguns grandes); Ollama é instalado à parte; Apple Vision não precisa de nada |
| Velocidade | ~3 min para um vídeo de 30 minutos em 1080p com legendas em inglês num Mac Apple M4 com 16 GB de RAM e ajustes padrão (~10× o tempo real) | Varia muito conforme o mecanismo; o Apple Vision é rápido, enquanto os mecanismos de modelos de visão precisos são pesados por quadro (mais lentos sem uma GPU rápida) |
| Ignorar logotipos, marcas d'água e texto na tela | Filtrado automaticamente fora das linhas de legenda | Tudo o que cai na caixa de varredura passa por OCR; é preciso reenquadrar para excluir |
| Plataforma | Apps de desktop para Mac e Windows | Windows / Linux / macOS (os mecanismos disponíveis variam por sistema) |
| Preço | Plano gratuito para OCR; há planos pagos — consulte os preços atuais na página inicial | Gratuito, de código aberto |
Ele encontra as linhas de legenda por você
A maior diferença é que o GeekLink trata a extração como um problema de legenda, não como um problema de um retângulo de pixels. O Video OCR do Subtitle Edit pede que você posicione uma caixa de varredura e então reconhece qualquer texto que apareça dentro dela em cada quadro amostrado. Funciona, mas coloca o julgamento sobre você: se a caixa ficar um pouco apertada, a linha de cima menos frequente de uma legenda de duas linhas pode ficar de fora; se ficar folgada demais, o logotipo de um canal, uma marca d'água ou gráficos na tela são lidos como legendas.
O GeekLink detecta primeiro as linhas de legenda reais — antes do reconhecimento — e é construído de propósito para detectar a mais em vez de perder (uma linha que você não quer some com um clique; uma linha que nunca foi capturada é uma perda silenciosa). Ele preserva as linhas de baixa frequência que um recorte fixo tende a descartar e mantém o reconhecimento longe de logotipos e elementos sobrando. Você não precisa ajustar um retângulo para se proteger desses casos; a detecção cuida disso.
Ele reconhece com modelos ajustados a legendas
O reconhecimento do GeekLink é ajustado especificamente para o texto de legenda na tela — aquela tipografia estilizada, com contorno e às vezes pequena, que fica sobre um vídeo em movimento — em vez de um OCR de documentos genérico ou um modelo de visão genérico aplicado a um quadro de vídeo. É desse ajuste que vem a precisão em legendas reais: menos caracteres corrompidos em legendas estilizadas e resultados mais estáveis em texto CJK denso.
Os mecanismos do Subtitle Edit são de uso geral por concepção. O Apple Vision é rápido e não precisa de download, mas é um OCR de sistema genérico e pode ter dificuldade com legendas estilizadas ou CJK pequenas. Os mecanismos de modelos de visão (GLM-OCR, PaddleOCR-VL e companhia) são reconhecedores realmente fortes e cobrem muitos idiomas — mas são modelos genéricos que você aponta para um quadro, não um fluxo específico de legendas e, como observado abaixo, são as opções pesadas do tipo 'baixar primeiro'.
É muito mais rápido
Num Mac Apple M4 com 16 GB de RAM, o GeekLink extrai um vídeo de 30 minutos em 1080p com legendas embutidas em inglês em cerca de 3 minutos com os ajustes padrão — aproximadamente 10× o tempo real. Parte disso é não refazer trabalho: uma legenda permanece na tela por muitos quadros consecutivos, então reconhecer cada quadro amostrado de forma independente repete a mesma leitura várias vezes. O GeekLink combina as evidências de uma mesma legenda e pula os quadros em que nada mudou, de modo que o reconhecimento caro roda muito menos vezes.
O Subtitle Edit não publica um número de desempenho e, honestamente, isso varia muito conforme o mecanismo. O Apple Vision é rápido. Mas as opções precisas — os modelos de visão do llama.cpp, CrispEmbed, Ollama — são LLMs de visão pesados que rodam por quadro, o que pode ser lento, especialmente sem uma GPU rápida. Então, no Subtitle Edit, você muitas vezes troca velocidade por precisão no momento de escolher o mecanismo; o GeekLink busca oferecer ao mesmo tempo o caminho da precisão ajustada e o caminho rápido.
Nada para baixar ou instalar
O GeekLink vem pronto para rodar. Não há mecanismo de OCR para escolher nem modelo para buscar antes de começar: abra o app, aponte para o vídeo e vá. Os modelos de reconhecimento já estão preparados para você.
Com o Video OCR do Subtitle Edit, a preparação dos modelos depende do mecanismo que você escolher. O Paddle OCR baixa automaticamente no Windows e no Linux; os mecanismos de modelos de visão baixam um mecanismo mais um modelo (alguns grandes); o Ollama é uma instalação à parte que você mesmo gerencia. No macOS, o Apple Vision é o único caminho que não precisa de nada — mas também é o reconhecedor mais genérico, então em legendas mais difíceis, estilizadas ou CJK você é empurrado para os modelos de visão do tipo 'baixar primeiro' para melhorar a qualidade. O GeekLink evita essa bifurcação por completo: um único caminho, ajustado, sem nada para baixar.
Quando o Subtitle Edit é a melhor escolha?
Muitas vezes. O Subtitle Edit é um editor de legendas excelente, gratuito e de código aberto, e o seu OCR é um trunfo de verdade:
Você já edita no Subtitle Edit. Se as suas legendas já vivem no Subtitle Edit para ajuste de tempo e limpeza, fazer o OCR na mesma janela — e editar ali mesmo as linhas reconhecidas — é prático e não custa nada.
Você quer gratuito e de código aberto, ponto final. O Subtitle Edit é gratuito e aberto. Se preço e abertura pesam mais que velocidade e instalação sem complicação, é uma ótima resposta.
Você quer escolher um mecanismo de OCR específico. O Subtitle Edit deixa você escolher entre vários mecanismos e trocar por um modelo de visão específico (ou um mecanismo na nuvem) se tiver um motivo para preferi-lo.
Os dois também não se excluem: um padrão comum é fazer a extração rápida e sem complicação no GeekLink e levar o resultado ao Subtitle Edit para o ajuste fino de tempos. Ferramentas diferentes, forças diferentes.
Perguntas frequentes
O Subtitle Edit tem OCR para legendas embutidas?
Sim. O Subtitle Edit adicionou recentemente um recurso de Video OCR (Video → OCR burned-in subtitle…) que extrai as legendas embutidas de um vídeo como linhas editáveis. Você desenha um retângulo de varredura, escolhe um mecanismo de OCR e um idioma, e inicia o OCR. O GeekLink faz o mesmo trabalho, mas detecta as linhas de legenda automaticamente e usa modelos ajustados a legendas, então não há retângulo para ajustar nem mecanismo ou modelo para baixar.
Qual é mais rápido no OCR, GeekLink ou Subtitle Edit?
Depende do mecanismo do Subtitle Edit. O Apple Vision é rápido; os mecanismos de modelos de visão mais precisos (llama.cpp com GLM-OCR ou PaddleOCR-VL, CrispEmbed, Ollama) são pesados por quadro e podem ser lentos sem uma GPU rápida. O GeekLink extrai um vídeo de 30 minutos em 1080p com legendas em inglês em cerca de 3 minutos num Mac Apple M4 com 16 GB de RAM (cerca de 10x o tempo real), em parte por combinar quadros repetidos e pular os que não mudam em vez de reler cada quadro.
Preciso baixar modelos para usar o Video OCR do Subtitle Edit?
Para a maioria dos mecanismos, sim. O Paddle OCR baixa automaticamente no Windows e no Linux, e os mecanismos de modelos de visão baixam um mecanismo mais um modelo (alguns grandes); o Ollama é instalado à parte. No macOS, o Apple Vision não precisa de download, mas é um reconhecedor genérico. O GeekLink vem com os modelos de reconhecimento preparados, então não há nada para escolher ou baixar antes de começar.
Por que o GeekLink perde menos linhas de legenda?
O Subtitle Edit aplica OCR a qualquer texto que caia dentro do retângulo de varredura que você desenha, então um recorte um pouco apertado pode descartar a linha de cima menos frequente de uma legenda de duas linhas, e um recorte folgado pode captar logotipos ou texto na tela. O GeekLink detecta as linhas de legenda automaticamente e é feito para detectar a mais em vez de perder — você apaga uma linha indesejada com um clique, mas uma linha nunca é perdida em silêncio — e mantém o reconhecimento longe de marcas d'água e elementos sobrando.
O Video OCR do Subtitle Edit é preciso?
Pode ser, especialmente os mecanismos de modelos de visão, que são reconhecedores genéricos fortes em muitos idiomas. As contrapartidas são que a opção rápida (Apple Vision) é um OCR genérico que pode ter dificuldade com legendas estilizadas ou CJK pequenas, enquanto as opções precisas são downloads pesados que rodam por quadro. O GeekLink usa modelos ajustados especificamente para o texto de legenda na tela, buscando essa precisão sem a penalidade de velocidade ou instalação.
Posso usar os dois juntos?
Sim. Um padrão comum é extrair as legendas embutidas rapidamente no GeekLink sem instalar nada e depois abrir o resultado no Subtitle Edit para o ajuste fino de tempos e a limpeza. Eles se complementam — o GeekLink para uma extração rápida e sem complicação; o Subtitle Edit para um ambiente de edição gratuito e profundo.