操作指南 · OCR
如何在 Chrome 里提取图片中的文字
简短回答
把图片拖进本地 OCR 工作台——识别由内置在浏览器里的 Tesseract 引擎完成,图片绝不上传。几秒钟后你就能拿到可编辑、可选中的文字,直接复制。
- 1
点击 Image OCR 图标,选择“从图片文件取字”,打开工作台。
- 2
拖入、粘贴(Ctrl+V)或选取图片——PNG、JPG、WebP 或 BMP。
- 3
等几秒钟,内置引擎在本地完成文字识别。
- 4
对照原图检查可编辑的结果,改掉识别错的字符。
- 5
点击“全部复制”,把提取出的文字放进剪贴板。
你手上有一张文档照片、一张扫描的小票、一页演讲幻灯片,或一张带金句的梗图——文字被困在像素里。大多数“图片转文字”网站都要你把文件上传到它们的服务器,然后等待,再指望它没被留存。在 Chrome 里可以完全跳过上传:让 OCR 引擎在扩展里本地运行,图片从不离开你的电脑。
打开工作台,拖入图片
点击 Image OCR 图标,选择从图片文件取字。工作台支持 PNG、JPG、WebP 和 BMP——把文件拖进来、按 Ctrl+V 直接从剪贴板粘贴,或用文件选择器挑选。粘贴是最被低估的一招:用系统快捷键截个图,在工作台里按 Ctrl+V,搞定。
识别完全在你的浏览器里进行
图片一落进来,识别就开始了。背后没有任何云端 API:OCR 引擎(编译成 WebAssembly 的 Tesseract)和语言数据都打包在扩展里,整条流水线都跑在你的设备上。这带来三个实际好处:离线可用;每一页都分文不花;而且无论图片还是识别出的文字,都绝不触碰任何服务器。
先校对,再复制
结果面板把原图和识别文字并排显示,文本框可以直接编辑。OCR 对清晰的印刷体表现很好,对低对比度的照片就差一些,所以扫一眼输出,就地改掉个别错字,再点全部复制。哪个词看着可疑,点原图对照一下。
切换识别语言
识别语言选错,是输出乱码的头号原因。识别语言在弹窗和工作台里都能直接切换,语言数据和其他一切一样是内置的——切换从不触发下载,所以离线时也照样能切。
为什么不用上传网站?
如果只是午餐菜单的截图,上传网站大概无妨。但如果是合同、证件、医疗信函或任何工作文件,你就是在把文档发给一台你管不着的服务器,受一份你八成没读过的保留政策约束。本地 OCR 工具直接消除了这个问题:它免费、无需账号,而且你可以验证它零网络请求。如果你要的文字在屏幕上而不在文件里,同一个扩展还能截取页面区域并复制其中的文字。