OCR 자막이 깨져서 나온다면? 해결 방법

작성자 Flora Wang, 영상 현지화 전문가 · 2026년 7월 25일 게시 · 7분 분량

TL;DR: OCR이 깨지는 건 거의 항상 설정 문제가 아니라 입력 문제입니다. 자막 OCR을 망치는 4가지 원인은 저해상도 원본, 자막 줄 이상을 포함하는 OCR 영역, 텍스트 뒤의 복잡한 배경, 그리고 잘못된 인식 언어입니다 — 이 네 가지만 고치면 정확도가 크게 올라갑니다. 원본 화질 자체가 너무 낮다면 어떤 OCR로도 완벽하게 읽어낼 수 없으므로, 설정과 씨름하기보다는 에디터에서 빠르게 한 번 훑어 고치는 편이 더 빠릅니다.

OCR 결과가 왜 이렇게 깨질까요?

자막 OCR은 자막 "파일"을 읽는 게 아닙니다 — 애초에 그런 파일은 존재하지 않습니다. OCR은 프레임 단위로 텍스트가 담긴 이미지를 읽고, 거기서 보이는 형태를 문자로 바꿉니다. 그래서 결과물의 품질은 전적으로 그 이미지가 얼마나 선명한지에 달려 있습니다. 이미지가 흐릿하거나, 복잡하거나, 인식기가 예상하지 못한 언어로 되어 있으면 읽기 자체가 틀어지고, 잘못된 문자, 빠진 글자, 뜻을 알 수 없는 줄이 나오게 됩니다.

여기서 관점을 바꿔야 합니다. 결과물이 깨졌을 때 해결책은 숨겨진 정확도 슬라이더 같은 게 아닙니다. 대개 입력에 관한 네 가지 원인 중 하나입니다. 실제로 자막 OCR이 엉망이 되는 이유를 추적해보면 저해상도이거나 과도하게 압축된 원본, 자막 줄 이상을 포함하는 OCR 영역, 텍스트 뒤의 복잡하거나 명암 대비가 강한 배경, 또는 잘못된 인식 언어 중 하나로 귀결됩니다. 이 가이드에서는 이 네 가지를 하나씩 짚어보겠습니다.

자막 OCR이 깨지는 건 입력 문제입니다: 흐릿한 이미지, 복잡한 영역, 시선을 흩트리는 배경, 예상치 못한 언어 때문이지 켜고 끌 수 있는 고장 난 설정 때문이 아닙니다.

저해상도 또는 심하게 압축된 원본

가장 흔한 오독 원인입니다. 영상이 저해상도이거나 심하게 재압축되면 글자의 윤곽이 사라지면서 흐릿하고 뭉개진 모양이 되고, OCR은 "m"과 "rn"을 구분하지 못하거나 비슷하게 생긴 한자를 서로 혼동합니다. 설정을 아무리 조정해도 흐릿한 텍스트가 다시 선명해지지는 않습니다.

해결책은 가장 깨끗한 이미지를 OCR에 넣어주는 것입니다. 구할 수 있는 가장 높은 해상도의 영상을 항상 사용하세요. 같은 영상이라도 1080p 원본이 압축된 480p 재업로드본보다 훨씬 잘 인식됩니다. 채팅 앱으로 다운로드한 용량이 작은 파일과 원본 중 선택할 수 있다면 원본을 쓰세요. 그리고 가지고 있는 원본 자체가 정말 저화질이라면 기대치를 조정하는 게 좋습니다 — 어떻게 해도 오류가 어느 정도는 발생하니, 완벽한 결과를 쫓기보다는 나중에 정리하는 쪽으로 계획을 세우세요.

흐릿하고 뭉개진 텍스트는 OCR이 깨지는 가장 큰 원인이므로, 가지고 있는 가장 높은 해상도의 원본부터 시작하세요. 1080p 원본이 압축된 480p보다 훨씬 잘 인식됩니다.

OCR 영역이 자막 외의 요소까지 포함할 때

OCR에 지정한 영역에 자막 줄 외에 채널 로고, 구석의 워터마크, 화면 내 캡션, 스코어보드, 영상에 입혀진 크레딧 등이 포함되어 있으면 그 텍스트까지 함께 읽혀서 자막 줄에 쓰레기 값처럼 섞여 들어갑니다. 자막 자체는 완벽하게 인식되었더라도, 원래 대사가 아니었던 텍스트가 달라붙어서 결과물이 깨진 것처럼 보이게 됩니다.

해결책은 OCR 영역을 자막 줄에만 딱 맞게 좁혀서 지정하는 것입니다. 대개 화면 하단을 가로지르는 좁은 띠 형태이고 그 외에는 아무것도 포함하지 않습니다. GeekLink에서는 이 영역을 직접 지정할 수 있고, 색상·글자 크기·언어로 필터링도 가능해서 로고나 화면 내 캡션은 제외하고 자막만 읽게 할 수 있습니다. 원본 자체는 문제없는데 결과물이 여전히 지저분하다면, 영역을 좁게 잡는 것이 가장 빠르게 개선할 수 있는 방법입니다.

OCR 영역이 로고나 화면 내 텍스트와 겹치면 그 내용이 쓰레기 값처럼 자막 줄에 섞여 들어갑니다 — 영역을 자막에만 딱 맞게 좁혀서 지정하면 해결됩니다.

텍스트 뒤 배경이 복잡하거나 명암 대비가 강할 때

자막은 영상 위에 얹혀 있는 형태이기 때문에, 배경 영상이 밝거나, 디테일이 많거나, 움직임이 빠르면 글자가 배경과 뒤섞여 보일 수 있습니다. 흰색 자막이 눈 내리는 장면이나 계속 바뀌는 밝은 하이라이트 위에 있으면 실제로 읽기가 매우 어렵습니다 — 글자의 윤곽이 배경 속으로 사라지면서 오독이 발생합니다.

이럴 때는 여러 프레임에 걸쳐 텍스트를 읽는 방식이 도움이 됩니다. 같은 자막 줄이 화면에 머무는 동안 뒤쪽 그림은 계속 바뀌기 때문에, 똑같은 단어 뒤에 더 깨끗하고 어두운 배경이 나오는 프레임이 있고 그런 프레임에서는 정확히 인식됩니다. 영역을 좁게 지정하고 인식 언어를 올바르게 설정하는 것도 인식기가 배경이 아니라 글자에 집중하는 데 도움이 됩니다. 다만 현실적으로 배경과 대비가 매우 낮은 자막은 여전히 가장 어려운 경우이며, 몇 줄은 수동으로 고쳐야 할 수도 있습니다.

텍스트 뒤의 밝고 복잡한 영상은 글자를 배경에 묻히게 해서 오독을 일으킵니다. 여러 프레임에 걸쳐 읽으면 더 깨끗한 순간을 포착할 수 있지만, 대비가 매우 낮은 자막은 여전히 가장 까다로운 경우입니다.

잘못된 인식 언어

OCR은 어떤 언어를 기대해야 하는지 알고 있을 때 훨씬 정확하게 읽습니다. 해당 언어의 문자 형태를 기준으로 무엇을 보고 있는지 판단하기 때문입니다. OCR이 영어로 설정되어 있는데 자막이 중국어, 일본어, 한국어이거나 그 반대인 경우, 인식기가 엉뚱한 문자 체계를 맞춰보려고 하기 때문에 첫 글자부터 결과가 엉망이 됩니다.

해결책은 10초면 끝납니다. 실행하기 전에 인식 언어를 자막 언어에 맞게 설정하세요. 화면에 두 가지 언어가 함께 있는 경우(예: 이중 언어 자막)라면 실제로 추출하고 싶은 언어를 선택하거나, 작업에서 가장 중요한 언어로 실행하면 됩니다. 이 부분을 먼저 제대로 맞추는 것만으로도 완전히 읽을 수 없던 결과가 깔끔해지는 경우가 많으니, 다른 원인을 의심하기 전에 먼저 확인해볼 가치가 있습니다.

인식 언어가 자막 언어와 맞지 않으면 결과물은 뜻을 알 수 없는 텍스트가 됩니다 — 실행 전에 언어를 자막 언어에 맞게 설정하고, 이 부분을 가장 먼저 확인하세요.

OCR이 여전히 완벽하지 않을 때

한계를 솔직히 인정할 필요가 있습니다. 어려운 원본에서는 어떤 OCR도 100% 정확할 수 없습니다. 깨끗하고 고해상도이며 배경이 단순한 영상에서는 정확도가 거의 완벽에 가깝지만, 배경이 복잡하고 스타일이 화려한 글꼴을 쓴 압축 다운로드 영상에서는 항상 몇 개의 오독이 남습니다. 설정을 조금씩 바꿔가며 다시 실행해서 완벽함을 좇는 방식은 대개 더 느린 길입니다.

더 빠른 방법은 순서를 반대로 하는 것입니다. 가능한 한 입력을 먼저 고치고 — 구할 수 있는 최고 해상도, 좁게 지정한 영역, 올바른 언어 — 그다음 다시 실행하는 대신 남은 몇 개의 오독을 에디터에서 고치는 방식입니다. Mac에서 GeekLink는 OCR을 로컬에서 직접 실행하고, 영역과 인식 언어를 설정할 수 있게 해주며, SRT를 내보내기 전에 내장 에디터에서 잘못 읽힌 줄을 수정할 수 있게 해줍니다. 줄을 훑어보면서 틀린 몇 개만 고치고 한 번에 내보내는 편이, 어려운 원본을 완벽하게 읽어내는 설정 조합을 찾아 헤매는 것보다 거의 항상 더 빠릅니다.

어려운 원본에서는 어떤 OCR도 완벽하지 않으므로, 입력을 먼저 고치고 다른 설정으로 다시 실행하는 대신 남은 오독을 에디터에서 고치세요.

FAQ

왜 OCR 결과에 잘못된 문자가 가득할까요?

대개 저해상도 원본이거나 잘못된 인식 언어 때문이니 이 두 가지를 먼저 확인하세요. 압축된 영상에서 나오는 흐릿하고 뭉개진 텍스트가 가장 흔한 원인이며, 언어가 맞지 않으면 처음부터 읽을 수 있는 텍스트가 뜻 모를 문자로 바뀝니다. 가지고 있는 가장 높은 해상도의 원본부터 시작하고, 인식 언어가 자막 언어와 일치하는지 확인하세요.

OCR이 자막과 화면 내 텍스트를 섞어서 인식했어요 — 어떻게 막을 수 있나요?

OCR 영역을 자막 줄에만 딱 맞게 좁혀서 지정하고, 색상이나 영역으로 필터링해서 로고와 캡션은 무시되도록 하세요. 선택한 영역에 워터마크, 채널 로고, 화면 내 캡션이 포함되어 있으면 그 텍스트까지 자막 줄에 함께 읽혀 들어갑니다. 화면 하단을 가로지르는 좁은 영역과 색상·언어 필터를 함께 사용하면 자막만 남길 수 있습니다.

OCR 결과가 엉뚱한 언어로 나오거나 완전히 뜻을 알 수 없어요.

인식 언어가 자막 언어와 맞지 않는 경우입니다. 자막 언어에 맞게 설정한 뒤 다시 실행하세요. OCR이 영어를 기대하는데 자막이 중국어, 일본어, 한국어이거나(또는 그 반대) 그럴 경우 모든 문자가 잘못 나옵니다. 실행 전에 올바른 언어를 설정하는 것만으로도 완전히 읽을 수 없던 결과가 한 번에 해결되는 경우가 많습니다.

자막 OCR이 100% 정확할 수 있나요?

아니요 — 깨끗하고 고해상도인 원본에서는 매우 정확하지만, 어려운 원본은 항상 간단한 사람의 검토가 필요합니다. 압축된 다운로드 영상, 복잡한 배경, 화려한 스타일의 글꼴은 몇 개의 오독을 남깁니다. 가장 빠른 방법은 입력을 먼저 고치고, 내보내기 전에 남은 줄을 에디터에서 수정하는 것입니다.

저화질 영상은 어떻게 OCR 해야 하나요?

구할 수 있는 가장 좋은 화질의 영상을 사용하고, 영역을 좁게 지정하고 올바른 언어를 설정한 뒤, 남은 오류는 에디터에서 수정하세요. 저해상도이거나 심하게 압축된 원본은 절대 완벽하게 OCR되지 않으므로, 구할 수 있는 가장 깨끗한 화질을 목표로 하고, 영역을 자막에만 좁게 지정하고, 인식 언어를 맞춘 다음, 나중에 몇 줄은 직접 손볼 계획을 세우세요.

관련 아티클

깨진 OCR을 빠르게 고치는 방법

GeekLink는 Mac에서 로컬로 자막을 읽고, 영역과 언어를 설정할 수 있게 해주며, SRT를 내보내기 전에 에디터에서 오독을 수정할 수 있게 해줍니다.

무료 다운로드