操作指南 · OCR
如何在 Chrome 里复制截图中的文字
简短回答
框选页面上带文字的区域——或粘贴一张现成截图——让本地 OCR 引擎把它变成可选中的文字。一切识别都在你的浏览器里完成:不上传、无需账号、可离线。
- 1
在有目标文字的页面上,点击 Image OCR 图标。
- 2
选择截取并框住文字区域——或按 Ctrl+V 把现成截图粘贴进工作台。
- 3
让内置 OCR 引擎在本地识别该区域;不上传任何内容。
- 4
对照原图校对可编辑的识别结果。
- 5
点击“全部复制”,把文字粘贴到任何需要的地方。
有些文字就是选不中:报错弹窗、烙在图片里的文字、视频画面、被渲染成图片的 PDF、图表标签。常见的变通办法——手动重打一遍,或把截图传到“图片转文字”网站——要么慢,要么等于把你的屏幕内容交给一台服务器。在 Chrome 里,一款 OCR 扩展可以把整件事都在本地做完。
框选带文字的区域
点击 Image OCR 图标,选择截取选项。扩展会截取当前标签页(用的是 Chrome 的 activeTab 权限,所以它只能看到你主动调用它的那个页面),并在上面盖一层取景框。拖一个框圈住你要的文字——只框那个弹窗、只框那行说明——只有框内区域会送去识别。框得越紧,结果越快越干净。
或者粘贴一张现成的截图
如果截图已经存在——来自手机、同事发的消息、系统截图工具——那就改为打开工作台,按 Ctrl+V 粘贴或把文件拖进去。PNG、JPG、WebP、BMP 都支持。截取和文件输入走的是同一条本地流水线。
文字在你的设备上识别
识别由编译成 WebAssembly、随扩展打包的 Tesseract 引擎完成,语言数据也一并内置。运行时不拉取任何东西,也不发出任何东西——截图绝不离开浏览器,关掉 Wi-Fi 一样能用。识别出的文字显示在原图旁边的可编辑文本框里;哪个词看着不对就点原图对照,就地改掉错字,再点全部复制。没有账号,也没有截取次数限制。
遇到无法截取的页面
Chrome 禁止扩展注入浏览器内部页面(chrome:// 设置页、应用商店等),取景层在那里跑不起来——弹窗会明确告诉你。变通办法也正是你想的那个:对那个页面做一次普通的系统截图,再粘贴进工作台。同一个引擎,同样的结果。
留意识别语言
如果截图的语言和识别器预期的不一致,输出就成了一锅粥。截取前先在弹窗里切换识别语言——语言数据随扩展打包,切换是瞬时的。至于存在文件里而非屏幕上的图片,见姊妹篇如何在 Chrome 里提取图片中的文字。