GeekLink OCR

영상에 표시된 자막을 편집 가능한 자막 파일로 변환합니다.

OCR 사용 한도 새 기기에는 매월 60분의 무료 OCR 내보내기 한도가 제공됩니다(매월 초기화). 친구를 초대하면 무료로 더 늘릴 수 있습니다: 친구가 내 전용 링크로 앱을 설치하고 실행하면 자동으로 적립되어 친구는 매월 +30분, 나는 +60분을 받습니다(코드 입력 불필요). 무제한 OCR 내보내기는 앱의 OCR 요금제를 선택하세요.

OCR을 사용할 때

문자 인식 (OCR) 기능은 영상 화면에서 기존의 번인 자막(하드 자막)을 추출하여 편집 가능한 SRT 자막 파일을 생성합니다. 영상에 이미 보이는 자막이 있지만 별도의 자막 파일이 없는 경우에 적합하며, 인터넷에서 다운로드한 자막이 포함된 영상, TV 프로그램 녹화본 등에 활용할 수 있습니다.

OCR은 오디오 트랙이 아닌 영상 화면을 분석하므로, 사용할 수 있는 오디오가 없어도 화면에 번인된 텍스트를 추출할 수 있습니다.

사용 방법

  1. "하드코딩 자막 추출(OCR)" 선택홈 화면에서 OCR 카드를 선택합니다.
  2. 영상 가져오기영상을 OCR 작업 공간으로 드래그하거나 "영상 선택"을 클릭합니다. SRT는 받지 않습니다.
  3. "문자 인식 실행" 클릭설정을 확인한 후 버튼을 클릭하여 처리를 시작합니다.
  4. 자막 줄 확인선택 화면이 열리면 안정적으로 표시되는 모든 텍스트 줄이 자동으로 감지됩니다 — 자막과 채널 로고가 각각 독립 항목이 되고 언어 드롭다운(자동 미리 채움)이 붙습니다. 불필요한 줄을 삭제하고 각 줄의 언어를 확인한 뒤 확인을 누르세요. 누락된 줄은 화면에서 드래그로 감싸면 추가됩니다(자세한 내용은 아래 참조).
  5. 색상 샘플링 (선택 사항)더 많은 설정에서 "자막 필터 미세 조정 (색상)"을 켠 경우에만 색상 선택기 단계로 이동합니다 — 영상 프레임에서 자막 텍스트를 칠하여 색상을 샘플링합니다(자세한 내용은 아래 설명 참조). 켜지 않은 경우 OCR이 박스 안의 모든 줄을 읽으므로 이 단계는 건너뜁니다.
  6. 색상 확인색상 선택기에서 칠하기를 완료한 후 "색상 확인"을 클릭하여 계속합니다.
  7. OCR 완료 대기시스템이 자동으로 영상 화면을 프레임별로 스캔하여 텍스트를 추출합니다.
  8. 결과 확인완료되었습니다! 자막 편집기를 열어 인식 결과를 확인하고 편집하세요.

자막 줄 확인

실행을 클릭하면 선택 화면이 열리고 안정적으로 표시되는 모든 텍스트 줄이 자동으로 감지됩니다. 각 줄은 전용 색상으로 화면에 표시되고 오른쪽에 해당 항목이 나타납니다. 자막, 채널 로고, 워터마크는 각각 별도의 줄이 됩니다 — 불필요한 줄을 삭제하고 각 줄의 언어(자동으로 미리 채워지지만 한 번 확인하세요)를 점검한 뒤, 타임라인을 드래그해 확인하고 확인을 누르세요. 확인한 줄의 언어에 따라 인식 엔진도 자동 선택됩니다: 중국어 줄과 영어 줄을 남기면 중영 이중 언어 인식이 자동으로 켜집니다.

누락된 줄이 있으면 화면에서 드래그로 감싸세요 — 정확한 경계를 가진 자막 상자로 추가되며, OCR은 감싼 범위만 읽습니다. 감지된 줄과 상자는 공존할 수 있고, 각 항목은 삭제 버튼으로 개별 삭제할 수 있습니다. OCR은 확인된 줄과 상자만 읽고 화면의 나머지는 모두 무시합니다.

엣지 케이스를 위한 두 가지 보조 기능: 전체 영상 심층 분석(약 1-2분)은 영상 일부에만 나타나는 드문 자막도 찾아내고, 선택 화면에서 영상이 재생되지 않으면(구형 시스템) 미리보기용 변환 버튼이 나타나 한 번의 클릭으로 미리보기 사본을 만듭니다(인식에는 영향 없음).

인식이 진행되는 동안에도 제어할 수 있습니다: 진행 표시줄 옆 작업 중지로 실행을 취소할 수 있고(인식된 부분은 유지), 인식하면서 에디터로 확인을 누르면 자막 에디터가 읽기 전용으로 열려 각 구간이 완료될 때마다 화면과 대조하며 결과를 확인할 수 있습니다.

영역 선택 화면은 이제 감지된 텍스트 영역을 실시간으로 강조 표시합니다. 일시 정지하거나 타임라인을 드래그하면 OCR이 읽어들일 모든 텍스트 주위에 감지 박스가 나타나므로, 박스가 정확한지, 다른 텍스트가 끼어들지 않았는지 한눈에 확인할 수 있습니다(필요 없으면 "텍스트 감지 박스 숨기기"를 체크하여 오버레이를 끌 수 있습니다). 게임 UI 숫자나 구석의 작은 캡션처럼 작은 방해 텍스트가 박스 안에 들어온다면 "작은 글자 무시" 슬라이더를 드래그하세요. 걸러진 감지 박스가 실시간으로 흐려지므로, 자막만 선명하게 강조된 상태가 될 때까지 드래그하면 됩니다.

GeekLink에서 자막 영역을 박스로 지정 — OCR이 박스 안의 텍스트만 읽습니다

자막 필터 미세 조정 — 색상(선택 사항)

기본적으로 OCR은 박스 안의 모든 텍스트 줄을 읽습니다. 그래도 자막과 비슷한 크기의 잡음 — 같은 영역에 있는 워터마크나 화면 내 표시 — 이 박스에 함께 잡힌다면, 더 많은 설정에서 "자막 필터 미세 조정 (색상)"을 켜세요. 실제 자막을 색상으로 분리하는 선택기 단계가 추가됩니다. 켜지 않으면 OCR은 박스 안의 모든 것을 그대로 읽습니다. (글꼴 크기로 필터링하는 기능은 이제 영역 선택 단계의 "작은 글자 무시" 슬라이더에 내장되어 있으므로, 그 용도로는 이 옵션을 켤 필요가 없습니다.)

GeekLink OCR 선택기 — 자막 색상 샘플링 및 감지된 글꼴 크기로 필터링(39px 자막 vs 94px 화면 내 제목)

자막 색상 샘플링

가능하면 자막 텍스트의 획 위에 직접 칠하고, 자막 주변의 배경 영역은 피하세요. 샘플링이 정확할수록 인식 결과가 좋아집니다.

글꼴 크기 필터링은 어디로 갔나요?

글꼴 크기 필터링은 영역 선택 단계로 앞당겨졌습니다. "작은 글자 무시" 슬라이더를 드래그하면 감지 박스가 실시간으로 흐려지며 작은 방해 텍스트를 걸러낼 수 있어, 여기서 픽셀 값을 직접 입력할 필요가 없어졌습니다. 색상 선택 화면은 이제 색상 샘플링 한 가지에만 집중합니다.

다른 언어 제외(선택 사항)

일부 프레임에는 두 가지 문자 체계의 번인 텍스트가 동시에 포함되어 있습니다 — 예를 들어 일본어 영상에 중국어 자막이 위에 추가되거나, 한 언어로 된 화면 표지판 아래에 다른 언어의 자막이 있는 경우입니다. "텍스트 필터링" 설정을 사용하면 문자 체계 전체를 제외하여 OCR이 무시하도록 할 수 있습니다. 원하지 않는 언어(일본어, 한국어, 중국어, 태국어, 아랍어)를 선택하면 해당 텍스트가 제거되어 자막 줄만 남습니다.

OCR 설정 상세

설정 설명 권장 사항
순간 표시 무시 임계값보다 짧게 나타나는 자막 줄을 제외합니다(조명 오인식, 페이드 잔상) — 끄기 / 0.15s / 0.28s(기본) / 0.5s 기본값을 유지하세요. 각 자막 줄의 언어는 이제 선택 화면에서 줄별로 선택합니다
자막 영역 스캔 범위 제한: 하단 / 하단 20% / 상반부 / 전체 화면 자막은 보통 하단에 있으므로 "하단" 또는 "하단 20%"를 선택하면 오인식을 줄이고 속도를 높일 수 있습니다
감지 간격 프레임 추출 빈도: 0.1초(가장 정밀) / 0.25초 / 0.3초 / 0.5초 / 1.0초 기본값으로 충분합니다. 자막이 빠르게 전환되거나 순간적으로 나타나는 영상은 0.1초로 낮추세요(처리 시간은 늘어납니다)
텍스트 필터 지정된 언어의 문자를 제외 화면에 필요 없는 일본어/한국어/태국어 등이 있을 때 사용하세요
모든 텍스트 추출 색상 샘플링을 건너뛰고 화면의 모든 텍스트를 추출 자막 색상이 고정되지 않거나 여러 색상인 경우 사용하세요
AI 향상 PRO 구두점 교정 + 시각적 재검사로 OCR 품질을 향상 처리 속도가 느려지므로 필요에 따라 활성화하세요

자주 묻는 질문

왜 많은 깨진 문자가 인식되나요?

색상 샘플링이 충분히 정확하지 않아 OCR 엔진이 배경 텍스처도 텍스트로 처리했을 수 있습니다. 다시 샘플링하여 자막 텍스트의 획 영역만 칠하는 것을 권장합니다. 자막이 더 선명한 다른 프레임에서 다시 작업해 보세요.

어떤 언어를 지원하나요?

현재 OCR은 다음 언어를 지원합니다: 영어, 중국어 간체, 중국어 번체, 중영 이중 언어, 일본어, 한국어, 베트남어, 스페인어, 포르투갈어, 프랑스어, 독일어, 이탈리아어, 인도네시아어.

왜 일부 자막이 인식되지 않나요?

감지 간격이 너무 커서 자막이 순간적으로 지나가 샘플링되지 않았을 수 있습니다. 감지 간격을 0.1초(가장 정밀)로 낮추면 더 빠르게 전환되거나 순간적으로 나타나는 자막도 포착할 수 있습니다. 단, 처리 시간이 그에 따라 늘어납니다.