跳到主要内容

Quantum OCR Windows 教程:框选屏幕文字与字幕

Quantum OCR 是一款 Windows 桌面 OCR 工具,可将屏幕上可见的文字转换为可复制文本。按下 Alt + Q 后框选屏幕区域即可识别文字;也可以使用字幕监控功能持续读取固定区域,并汇集新出现的字幕行。核心识别使用安装在电脑上的模型,OCR 过程不会上传截图。

系统要求与功能​

项目说明
平台Windows 10 或 Windows 11,x64 安装包
屏幕框选按 Alt + Q,拖动鼠标框选待识别文字
字幕监控监控选定的屏幕区域,并合并相邻重复字幕
识别方式使用本地 OCR 模型;核心识别无需上传截图
费用核心 OCR 和区域框选功能免费

Quantum OCR 识别的是屏幕上当前可见的文字,适用于视频流字幕、游戏对白、文档和应用界面。它不会转录音轨中的语音,也不会直接从视频文件生成带时间码的 SRT 字幕。

框选屏幕文字​

  1. 从 Quantum OCR 产品页 下载并安装 Windows x64 版本。
  2. 打开 Quantum OCR,按 Alt + Q。
  3. 拖动鼠标框选包含文字或字幕的区域。
  4. 检查识别结果,然后编辑或复制。之后可在相应的 Quantum Subtitle 工具中继续翻译或整理字幕。

监控固定区域的字幕​

  1. 在 Quantum OCR 中打开字幕监控功能。
  2. 选中视频、直播或游戏中显示字幕的区域。
  3. 字幕出现时开始监控。工具会持续读取所选区域,并合并相邻重复的字幕画面,让结果集中显示新内容。
  4. 在应用中检查并复制识别到的文字。

尽量让字幕区域保持固定,并将框选范围控制在字幕附近,避免包含无关界面文字。场景切换、动态文字、对比度低,或字幕移出选定区域,都可能降低识别效果。

应该使用哪个工具?​

已有内容工具输出
Windows 屏幕上可见的文字或字幕Quantum OCR从屏幕区域识别出的可复制文本
带有硬编码字幕的视频文件字幕提取器通过视频 OCR 提取可编辑字幕和 SRT
音频或视频文件中的口语对白语音识别带时间码的转录文本和 SRT

视频 OCR 操作步骤请参阅字幕提取器教程。若要将语音转为字幕,请参阅语音识别教程。

常见问题​

Quantum OCR 会上传截图吗?​

核心 OCR 使用安装在电脑上的模型进行识别。产品页说明,此识别流程不会上传截图。这是一款 Windows 桌面应用,而不是通过浏览器上传截图的在线工具。

Quantum OCR 能从电影生成 SRT 文件吗?​

Quantum OCR 识别的是实时屏幕中选定区域的文字,不能直接从视频文件生成带时间码的 SRT。若视频已烧录字幕,请使用字幕提取器;若要识别口语对白,请使用语音识别。

Quantum OCR 免费吗?​

Quantum OCR 产品页列出的核心 OCR 和区域框选功能为免费功能。请在产品页查看当前 Windows 下载和最新说明。

打开 Quantum OCR​

前往 Quantum OCR Windows 产品页下载当前安装包并查看最新功能。