太長不看:subs2srs(把句子挖進 Anki)需要一個帶時間軸的字幕檔加上音訊。但很多沉浸式素材 — 動畫壓製檔、日本 YouTube、陸劇 — 都把字幕燒錄進畫面,所以沒有字幕檔可供 subs2srs 使用。這就是為什麼 subs2srs 指南叫你避開硬字幕內容。解法:先把燒錄字幕 OCR 成一個帶時間軸的 SRT,再把那個 SRT 加上影片餵進 subs2srs。GeekLink 在 Mac 上完成 OCR 這一步,並具備幀級準確的時間軸(正是 subs2srs 所仰賴的);而如果影片完全沒有字幕,它也能改為轉錄音訊。
如果你找到一支完美的沉浸式影片 — 程度剛好、主題你愛 — 但字幕卡在畫面裡,你不必因此放棄它。你只需要在 subs2srs 之前多做一步。
為什麼 subs2srs 用不了硬字幕?
subs2srs 是靠依照字幕檔中的時間軸切分影片的音訊與截圖來建立 Anki 卡片。它需要一個帶時間軸、真正的 .srt/.ass 檔案。
硬字幕(燒錄)字幕不是檔案 — 它們是畫進每一格畫面的像素。沒有帶時間軸的文字供 subs2srs 切分,這就是為什麼標準建議字面上就是「下載沒有把字幕烙進畫面的版本」。像 Yomitan 或 SubMiner 這類播放器內挖掘工具也有相同限制:它們讀取播放器中顯示的真正字幕軌道,而非烙進畫面的文字。
所以缺的那一步,就是把那些燒錄字幕變回一個帶時間軸的字幕檔 — 也就是對影片畫面做 OCR。
把燒錄字幕變成 subs2srs 可用的 SRT(在 Mac 上)
- 用 GeekLink 對硬字幕做 OCR。匯入影片、選擇「字幕已經在畫面上」、在字幕區域上框一個框,它就把文字讀成一個帶時間軸、可編輯的 SRT — 本機執行,免費。
- 修正任何被標記的地方。GeekLink 會標出它沒把握的行,所以你只需修正少數幾行、而不必重讀全部 — 這很重要,因為乾淨的文字能做出更乾淨的卡片。
- 把 SRT + 影片餵進 subs2srs。現在你有了一個時間軸正確、真正的字幕檔,subs2srs 就能照常切分音訊與截圖並建立你的牌組。
- 匯入 Anki 然後開始學習。
為什麼時間軸準確度對 subs2srs 很重要
subs2srs 使用字幕行的起/訖時間軸來切出每張卡片的音訊。如果時間軸不對,你的卡片會播出錯誤的音訊 — 片段開始得太早,或把句子切掉了。這正是初學者手動抓字幕時容易弄錯的地方。
GeekLink 逐格偵測每一行字幕確切的出現與消失時刻,所以 SRT 與影片時間對齊。就算你不在意 OCR 文字是否完美(反正你會從音訊認出那個字),時間軸也會是對的 — 這才是讓卡片可用的關鍵。
如果影片完全沒有字幕怎麼辦?
有時你的沉浸式片段有乾淨的音訊,但沒有螢幕上的字幕可 OCR。在那種情況下,跳過 OCR,改為從音訊產生字幕 — GeekLink 把語音轉錄成一個帶時間軸的 SRT(以 Whisper 為基礎),你再以同樣的方式把它餵進 subs2srs。一款 App 同時涵蓋燒錄字幕與純音訊兩種情況。
常見問題
我能用 subs2srs 處理硬字幕嗎?
沒辦法直接用 — subs2srs 需要一個字幕檔,而硬字幕是畫面裡的像素,不是檔案。先把它們 OCR 成一個帶時間軸的 SRT,subs2srs 就能照常運作。
我要怎麼從把字幕燒錄進去的動畫(或影片)取得字幕?
執行畫面 OCR:在字幕區域上框一個框,讓 GeekLink 把燒錄文字讀成一個可編輯、時間同步的 SRT。那個 SRT 就是你餵進 subs2srs 或在 Anki 工具中打開的東西。
OCR 文字準確度對句子挖掘重要嗎?
比你想的次要。對挖掘來說,必須對的是時間軸(這樣音訊片段才正確);小小的 OCR 文字誤差很容易修正,而你會從音訊認出那個字。GeekLink 也會標出它沒把握的行,所以你只修那些就好。
它適用於日文、中文與韓文嗎?
適用 — GeekLink 使用專門的 CJK OCR 模型處理日文(漢字 + 假名)、中文(簡體/繁體)與韓文(諺文),也支援拉丁文字。
它免費嗎?在 Mac App Store 上嗎?
擷取並匯出字幕是免費的。GeekLink 是從 geeklink.dev 直接下載 — 非 Mac App Store — 且無須帳號。
相關文章
揭露:GeekLink 是我們自己的產品,為 Mac 上的燒錄字幕 OCR 與語音轉文字而打造。subs2srs 與 Anki 是我們為挖掘步驟連結過去的獨立免費工具。