选择或拖入图片
也可以截图后直接按 Ctrl+V(Mac 是 ⌘V)粘贴
字很小或很模糊时放大 2–3× 往往有帮助;手机拍的文件有阴影、一边暗一边亮时,试试「黑白(光照不均)」。
说明和已知局限
- 首次加载约 8 MB:识别引擎约 4 MB,中文语言包约 1.7 MB,英文约 2 MB(用 tessdata_fast 精简版,所以体积小、速度快,准确率比完整版略低)。只识别英文时约 6 MB。下载后浏览器会缓存,之后再用基本不用重新下载。手机流量下请留意。
- 识别速度:在手机上识别一张整页文件可能要十几秒到几十秒,电脑上通常几秒;进度条会显示。
- 竖排:有一个「竖排的简体中文」选项(使用竖排专用语言包,首次再多下载约 1.2 MB),但准确率明显低于横排,目前只适合整块、排版干净的竖排文字,混有横排的页面不要选它。
- 表格:本工具只做文字识别,不还原表格线。打开「表格:大间隔用制表符分开」后,同一行里间隔很大的文字会用制表符隔开,复制到 Excel 里会自动分到不同的格子;复杂表格、合并单元格仍然会乱,请逐块框选识别。
- 手机拍照歪斜:载入图片后会尝试自动校正歪斜(适合文字行清晰的文档,对竖排、照片类图片不适用),也可以拖动滑块或用 ↺ ↻ 手动转正;拍的时候尽量正对着、光线均匀,比事后补救效果好得多。
- 手写字、艺术字、很花的背景:识别率很低,这是这类引擎的普遍限制。
- 黄色标记:表示引擎自己对这个词没把握(置信度低于 70%),不代表一定错,但请对照原图检查;鼠标移到标记上,图片上对应位置会变红。置信度高不代表一定对,数字、金额、身份证号等重要内容务必人工核对。
- iPhone 的 HEIC 照片:Safari 可以直接打开,其他浏览器不行,可以先用本站的「图片压缩」转成 JPG。PDF 请先转成图片再来。
图片 示例
识别结果(可以直接修改)