Quantum OCR Windows 教程:框选屏幕文字与字幕
Quantum OCR 是一款 Windows 桌面 OCR 工具,可将屏幕上可见的文字转换为可复制文本。按下 Alt + Q 后框选屏幕区域即可识别文字;也可以使用字幕监控功能持续读取固定区域,并汇集新出现的字幕行。核心识别使用安装在电脑上的模型,OCR 过程不会上传截图。
系统要求与功能
| 项目 | 说明 |
|---|---|
| 平台 | Windows 10 或 Windows 11,x64 安装包 |
| 屏幕框选 | 按 Alt + Q,拖动鼠标框选待识别文字 |
| 字幕监控 | 监控选定的屏幕区域,并合并相邻重复字幕 |
| 识别方式 | 使用本地 OCR 模型;核心识别无需上传截图 |
| 费用 | 核心 OCR 和区域框选功能免费 |
Quantum OCR 识别的是屏幕上当前可见的文字,适用于视频流字幕、游戏对白、文档和应用界面。它不会转录音轨中的语音,也不会直接从视频文件生成带时间码的 SRT 字幕。
框选屏幕文字
- 从 Quantum OCR 产品页 下载并安装 Windows x64 版本。
- 打开 Quantum OCR,按 Alt + Q。
- 拖动鼠标框选包含文字或字幕的区域。
- 检查识别结果,然后编辑或复制。之后可在相应的 Quantum Subtitle 工具中继续翻译或整理字幕。
监控固定区域的字幕
- 在 Quantum OCR 中打开字幕监控功能。
- 选中视频、直播或游戏中显示字幕的区域。
- 字幕出现时开始监控。工具会持续读取所选区域,并合并相邻重复的字幕画面,让结果集中显示新内容。
- 在应用中检查并复制识别到的文字。
尽量让字幕区域保持固定,并将框选范围控制在字幕附近,避免包含无关界面文字。场景切换、动态文字、对比度低,或字幕移出选定区域,都可能降低识别效果。
应该使用哪个工具?
| 已有内容 | 工具 | 输出 |
|---|---|---|
| Windows 屏幕上可见的文字或字幕 | Quantum OCR | 从屏幕区域识别出的可复制文本 |
| 带有硬编码字幕的视频文件 | 字幕提取器 | 通过视频 OCR 提取可编辑字幕和 SRT |
| 音频或视频文件中的口语对白 | 语音识别 | 带时间码的转录文本和 SRT |
视频 OCR 操作步骤请参阅字幕提取器教程。若要将语音转为字幕,请参阅语音识别教程。
常见问题
Quantum OCR 会上传截图吗?
核心 OCR 使用安装在电脑上的模型进行识别。产品页说明,此识别流程不会上传截图。这是一款 Windows 桌面应用,而不是通过浏览器上传截图的在线工具。
Quantum OCR 能从电影生成 SRT 文件吗?
Quantum OCR 识别的是实时屏幕中选定区域的文字,不能直接从视频文件生成带时间码的 SRT。若视频已烧录字幕,请使用字幕提取器;若要识别口语对白,请使用语音识别。
Quantum OCR 免费吗?
Quantum OCR 产品页列出的核心 OCR 和区域框选功能为免费功能。请在产品页查看当前 Windows 下载和最新说明。
打开 Quantum OCR
前往 Quantum OCR Windows 产品页下载当前安装包并查看最新功能。