GeekLink 现已自动检测烧录字幕 —— 你只需确认字幕行

作者:Flora Wang,视频本地化专家 · 更新于 2026 年 7 月 20 日 · 阅读约 6 分钟

一句话总结:过去,GeekLink 的 OCR 需要你自己在字幕区域画一个框,自己猜文字在哪里。现在不用了。它会扫描视频,自动检测出每一行字幕,并预填好每一行的语言。你只需要看一眼检测结果并确认——如果它误把台标当成了字幕,删掉那一行;如果漏检了某一行,拖框补上即可。对于字幕稀疏、比较难处理的视频,还提供深度扫描选项。整个过程依然在你的 Mac 上本地运行,并导出为可编辑的 SRT 文件。这一切都随 GeekLink 0.4 一起发布——这个版本也正式摘掉了 Beta 标签。

什么是烧录字幕?

烧录字幕(也叫硬字幕)是被永久绘制在视频画面里的文字。你能看到它们,但没有独立的字幕文件,无法关闭,也无法选中或复制文字。这种字幕随处可见:动漫压制资源、国产短剧、K-pop 饭拍、抖音和 B 站的搬运视频,以及老旧的电视录屏。如果你想从这类视频里得到一份可编辑、可翻译的字幕文件,就需要用 OCR 把画面里的文字重新读出来。

旧方式:画框然后祈祷

在此之前,GeekLink 需要你自己去找字幕的位置。你要拖动进度条找到一帧有字幕的画面,在文字大致所在的位置画一个框,然后祈祷这个框在整段视频里都能盖住字幕。框画小了,长一点的字幕行末尾会被裁掉;框画大了,又会把台标、水印或压根不是字幕的画面文字一起框进去。这个方法能用,但它把最难的判断——字幕到底在哪儿?——一开始就扔给了你。

新方式:GeekLink 自动检测字幕行

现在这部分工作 GeekLink 帮你做了。当你打开一个视频进行 OCR 时,它会在整段视频里采样,然后直接返回它找到的字幕行——直接画在预览帧上——而不是一个空框等你去填。每一行检测出的字幕都会自动预填好语言(中文、英文、日语、韩语等),因为系统会读取一段文字样本来判断语言,所以这一步也不需要你手动设置。

GeekLink showing auto-detected subtitle lines on the preview frame, each with its language pre-filled, ready to confirm
在一段双语视频上检测出的两行字幕——上面是中文,下面是英文——各自已预填好语言。你要做的只是确认,而不是去寻找。

对于一段双语视频,通常会得到你预期中的两行——原文和译文——各自标注好对应的语言,所以一段中文压英文的视频会被识别为两条独立的轨道,而不是混成一团。你需要做的只是看一眼:这些是不是我想要的字幕行?如果是,确认后就可以开始了。

自动检测不是魔法,我们也从没这么说过——所以修正它的操作就摆在那里,随时可用:

  • 把台标或水印识别成了字幕? 检测有时会把角标或频道水印当成一行字幕。只需在那一行点击删除,它就会被移除——不会被读取。
  • 漏检了一行? 不需要切换特殊模式或点"添加行"按钮。直接在预览画面上漏检字幕所在的位置拖框,它就会成为一条新的字幕行——大小完全按你画的框来,不会被自动扩展。
  • 某一行的语言识别错了? 每一行都有独立的语言下拉菜单,如果某一行识别有误,只改那一行即可,不影响其他行。

难处理的视频:扫描整段片段

快速检测是通过采样帧来保持速度的,这对大多数字幕几乎全程存在的视频来说是正确的做法。但有些片段比较稀疏——长时间没有文字,只在少数场景里出现字幕——快速采样可能会漏掉这些情况。针对这种情况,有一个深度扫描选项,它不做采样,而是遍历整段视频,因此稀疏的字幕行也能被找到。它会花更长时间,所以是可选项而非默认设置,但在视频需要的时候可以随时开启。

然后:编辑并批量导出

确认之后,OCR 会把画面上的文字读取到一份时间轴同步的字幕文件里——它会检测每一行出现和消失的时刻,所以出来的时间轴是对齐的,而不只是文字本身对齐。之后就是一份普通的可编辑字幕:在编辑器里修正需要修正的地方,导出为标准 .srt,可以在任意字幕编辑器中打开——Subtitle Edit、Premiere、Final Cut 都可以。如果你导入的是一整个文件夹的多集视频?系统会把每一集都排入队列,批量为每个视频导出一份字幕文件。

Editable subtitles extracted by GeekLink's OCR from a hardcoded-subtitle video, ready to export as SRT
提取出的字幕,可编辑、时间轴同步——随时可以导出为 SRT。

GeekLink 0.4 正式脱离 Beta

还有一件事值得直说:这是 GeekLink 正式告别 Beta 阶段的版本。从年初开始我们一直挂着 Beta 标签,因为核心流程——OCR 提取、语音识别、AI 翻译和字幕烧录——都还在成型阶段,需要被真实用户用真实素材反复打磨。到了 0.4,这套流程已经足够稳定,我们决定摘掉 Beta 标签。GeekLink 依然是 Mac 上的直接下载软件(Apple Silicon,macOS 13+),依然完全本地运行,也依然保留永久免费额度——这些都没有变。变化的是,我们现在有底气把它称为"稳定版"了。

如果你在早期 Beta 阶段试用过、又因为某个不太顺手的细节放弃了,上面说的 OCR 流程值得你再看一眼——曾经最需要你操心的那部分,现在换成它来替你操心了。

常见问题

如何在 Mac 上提取烧录字幕?

把视频导入 GeekLink,选择 OCR。它会扫描片段并自动检测字幕行,每一行都预填好语言。确认它找到的字幕行——删掉误识别成台标或水印的行,或拖框补上漏检的一行——之后它会把画面文字读取成可编辑、时间轴同步的 SRT 文件。整个过程都在你的 Mac 上本地运行。

GeekLink 是自动找到字幕区域,还是需要我自己画框?

自动完成。GeekLink 会在整段视频中采样,返回检测到的字幕行并直接画在预览帧上。只有当你想补上一条它漏检的字幕时,才需要手动画框——正常情况下由自动检测来处理。

如果画面里有台标或水印怎么办?

检测有时会把台标或水印误判为字幕行。你只需要在确认之前删掉那一行即可,它不会被读取。如果干扰文字和字幕颜色不同,你也可以在识别设置中按颜色微调字幕过滤规则。

能否同时识别两种语言,比如中文压英文的视频?

可以。对于双语片段,通常会分别检测出两行——原文和译文——各自标注对应的语言,因此会以两条独立轨道的形式呈现,而不是合并成一行。如果某一行的语言识别有误,也可以单独修改,不影响其他行。

如果字幕只出现在少数几个场景里怎么办?

可以使用深度扫描选项。默认的快速检测通过采样帧来保持速度,适合字幕几乎全程存在的视频。对于稀疏的片段——长时间没有文字——深度扫描会遍历整段视频而不是采样,因此仍然能找到这些字幕行。它会更慢,所以是可选项。

GeekLink 还处于 Beta 阶段吗?

不是了。从 0.4 版本开始,GeekLink 已经摘掉了 Beta 标签。核心流程——OCR、语音识别、AI 翻译和字幕烧录——已被认为是稳定的。它依然是面向 Apple Silicon、macOS 13 及以上系统的免费直接下载软件。

提取烧录字幕是免费的吗?

是的。OCR 字幕提取、编辑、批量处理和 SRT 导出永久免费。Pro 版本增加了 AI 翻译功能,并取消了少量导出额度限制——但仅仅是从视频中提取字幕,你并不需要 Pro。

信息披露:GeekLink 是我们自己的产品。本文描述的是 0.4 版本中当前 OCR 流程的实际工作方式,文中截图均来自 App 本身。

从任意视频中提取字幕

GeekLink 检测字幕行、从画面中读取文字,并导出可编辑的 SRT——全程在你的 Mac 上本地完成。

了解 OCR 工作原理