图片文字识别

把图片里的文字读出来,变成可复制的文本

加载中…

这个工具有帮助吗?

关于此工具

把照片或截图里的文字读出来,变成可以复制的文本。可以同时识别韩语和英语,结果能就地修改,再复制或存成 TXT。识别通过浏览器内的 WebAssembly 完成,图片不会上传到服务器;只有文字训练数据会在第一次使用时从外部 CDN 下载。

使用方法

  1. 把图片拖进来,或用 Ctrl+V 粘贴,也可以点截屏按钮。
  2. 选择语言。中韩英混排时选"韩语 + 英语"比较合适。
  3. 文字发虚就打开"增强对比",然后点识别文字。
  4. 检查结果,把认错的地方改好,再复制或保存为 TXT。

常见问题

准确率太低了。
影响最大的是分辨率。字高低于约 20 像素时识别率会急剧下降,所以尽量凑近重拍,或者先放大画面再截图。其次是倾斜 — 纸张歪着时,单是摆正再拍就能改善很多。
黑白和对比选项什么时候用?
对于灯光只照到一边、整页蒙着一层灰的文件照片最有效。提高对比会把那层灰推成白色,只留下字。相反,本来就清晰的截图用了没有帮助,还可能把细笔画切断。
能识别手写吗?
基本不能。这个识别引擎是按印刷体训练的,即使是工整的手写楷体,准确率也会大幅下降。
可以直接放 PDF 吗?
不行。请先用 PDF 工具把需要的页面拆出来,再截图放进来。如果 PDF 本身是文字版而不是扫描件,直接在阅读器里复制会准确得多。
图片会被上传吗?
不会。识别在浏览器内进行,图片不会离开这个标签页。唯一的对外请求是下载语言训练数据,而且只在第一次发生。

仅韩语训练数据就接近 20MB,首次运行需要等一会儿。如果按流量计费,建议先在 Wi-Fi 下跑一次。识别结果务必人工核对 — 尤其是数字和符号,经常被认成形状相近的字符。

类似工具