操作指南 · OCR
如何在 Chrome 里对 PDF 页面截图做 OCR
简短回答
遇到扫描版 PDF、文字选不中时,把那一页截图,粘贴进本地 OCR 工作台。引擎在扩展内部运行,文档从不上传——几秒钟后,那段文字就以可编辑的形式回到你手里。
- 1
在 Chrome 里打开 PDF,放大到你要的文字又大又清楚。
- 2
用系统截图截取页面或区域(Win+Shift+S / Cmd+Shift+4)——Chrome 的 PDF 查看器会阻止扩展叠加层,这才是可靠的截取路线。
- 3
点击 Image OCR 图标,打开“从图片文件取字”,按 Ctrl+V 粘贴截图。
- 4
选择识别语言——English,或用于中文文档的“中文 + English”。
- 5
对照截图校对可编辑的结果,改掉认错的字符。
- 6
点击“全部复制”,把找回的文字粘贴进你的笔记或文档。
扫描版 PDF 是伪装成文档的图片:页面照常渲染,却什么都选不中,Ctrl+F 一无所获。那些号称“在线 OCR 你的 PDF”的网站,解决办法是让你把整份文档——往往是合同、账单、医疗信函——上传到它们的服务器。而“截图 + 本地 OCR 扩展”的流程,能把文字取出来,文件却哪儿也不去。
截图之前先放大
在 Chrome 里打开 PDF,把你要的那段文字放大到又大又清晰。识别质量直接跟着截图质量走:100% 缩放下截的页可能错字连篇,放大到 150% 就干干净净。预期也要摆正——本地引擎最擅长干净的印刷体,最不擅长歪斜的扫描、低对比度和手写。
截下页面,粘贴进来
用系统截图截取页面或区域——Windows 上 Win+Shift+S,macOS 上 Cmd+Shift+4——然后点击 Image OCR 图标,打开从图片文件取字,按 Ctrl+V。有一点值得知道:Chrome 内置的 PDF 查看器会阻止扩展叠加层,扩展自带的区域截取没法把选框画到 PDF 标签页上。“系统截图 + 粘贴”才是可靠的路线,而且走的是完全相同的本地流水线。(如果 PDF 是在普通网页查看器里渲染的,区域截取就能用——直接框选即可。)

识别、修正、复制
截图一落进来,识别立刻开始——引擎是编译成 WebAssembly、打包在扩展内的 Tesseract,所以什么都不上传,离线也能用。随附两种识别语言:English,以及适用于中文文档的中文 + English;第一遍结果不对就当场切换。输出就在截图旁边的可编辑文本框里——校对、改掉个别错字,然后按全部复制。
一次一页——有意为之
这是一个读取流程,不是批量转换器:非常适合从扫描件里取出你真正需要的那段话、那张表或那一页,却不适合把 200 页的 PDF 转成文本文件。如果你要的是把 PDF 页面变成图片,见不上传就把 PDF 转成 JPG;如果文字在普通网页上,从截图中复制文字那篇讲的就是它。无论来源是什么,承诺不变:免费、无账号,从截图到复制文字全程零网络。