操作指南 · OCR

如何在 Chrome 里复制截图中的文字

Image OCR4 分钟阅读

简短回答

框选页面上带文字的区域——或粘贴一张现成截图——让本地 OCR 引擎把它变成可选中的文字。一切识别都在你的浏览器里完成:不上传、无需账号、可离线。

  1. 1

    在有目标文字的页面上,点击 Image OCR 图标。

  2. 2

    选择截取并框住文字区域——或按 Ctrl+V 把现成截图粘贴进工作台。

  3. 3

    让内置 OCR 引擎在本地识别该区域;不上传任何内容。

  4. 4

    对照原图校对可编辑的识别结果。

  5. 5

    点击“全部复制”,把文字粘贴到任何需要的地方。

有些文字就是选不中:报错弹窗、烙在图片里的文字、视频画面、被渲染成图片的 PDF、图表标签。常见的变通办法——手动重打一遍,或把截图传到“图片转文字”网站——要么慢,要么等于把你的屏幕内容交给一台服务器。在 Chrome 里,一款 OCR 扩展可以把整件事都在本地做完。

框选带文字的区域

点击 Image OCR 图标,选择截取选项。扩展会截取当前标签页(用的是 Chrome 的 activeTab 权限,所以它只能看到你主动调用它的那个页面),并在上面盖一层取景框。拖一个框圈住你要的文字——只框那个弹窗、只框那行说明——只有框内区域会送去识别。框得越紧,结果越快越干净。

或者粘贴一张现成的截图

如果截图已经存在——来自手机、同事发的消息、系统截图工具——那就改为打开工作台,按 Ctrl+V 粘贴或把文件拖进去。PNG、JPG、WebP、BMP 都支持。截取和文件输入走的是同一条本地流水线。

文字在你的设备上识别

识别由编译成 WebAssembly、随扩展打包的 Tesseract 引擎完成,语言数据也一并内置。运行时不拉取任何东西,也不发出任何东西——截图绝不离开浏览器,关掉 Wi-Fi 一样能用。识别出的文字显示在原图旁边的可编辑文本框里;哪个词看着不对就点原图对照,就地改掉错字,再点全部复制。没有账号,也没有截取次数限制。

遇到无法截取的页面

Chrome 禁止扩展注入浏览器内部页面(chrome:// 设置页、应用商店等),取景层在那里跑不起来——弹窗会明确告诉你。变通办法也正是你想的那个:对那个页面做一次普通的系统截图,再粘贴进工作台。同一个引擎,同样的结果。

留意识别语言

如果截图的语言和识别器预期的不一致,输出就成了一锅粥。截取前先在弹窗里切换识别语言——语言数据随扩展打包,切换是瞬时的。至于存在文件里而非屏幕上的图片,见姊妹篇如何在 Chrome 里提取图片中的文字

复制任何截图里的文字

框选页面区域或粘贴截图——文字变成可选中的文本,识别完全在你的设备上完成。

了解 Image OCR →