ImgWell.cn

手机拍的合同/单据照片,文字怎么变成可编辑文本(不用一个字一个字打)

手机拍了一份合同条款、一张发票、白板上的会议笔记,想把里面的文字发给同事、存进文档、或者翻译成另一种语言——第一反应通常是“复制一下就行”。结果长按屏幕、框选,什么都选不中,因为这终究只是一张照片,不是一段文字。

要么对着照片一个字一个字往外敲,要么找个工具“识别”出来。后者显然更省事,但具体怎么操作、识别出来靠不靠谱、会不会把照片传到什么服务器上——这篇一次说清楚。

为什么照片里的字不能直接复制

对电脑/手机来说,一张照片就是一堆像素点,不管这些像素排列起来在人眼看来像不像“字”,文件本身并不知道“这里写的是什么字”。想要复制粘贴,前提是这段内容以“字符”的形式存在,而不是“像素”——这就是为什么 Word 文档里的文字能直接选中,照片里的“文字”不能。

要把像素变成字符,需要 OCR(光学字符识别)——本质上是让程序“看图识字”,跟人眼认字是同一件事,只是换成了机器来做。

识别效果怎么样,能信到什么程度

先说实话:OCR 不是 100% 准确的技术,识别效果和照片本身的质量强相关。

所以 OCR 识别结果适合当作“起点”——省掉从头手打的功夫,但不适合直接当“终点”直接使用。尤其是照片里有金额、日期、合同条款、证件号码这类关键信息时,识别完务必对照原照片核对一遍再用,别直接复制粘贴就发出去了。

怎么把照片里的文字提取出来

  1. 打开 图片/扫描件转文字(OCR),把要识别的照片拖进去——支持一次拖多张,不用一张一张来。
  2. 点击“开始识别”。整个识别过程在你自己的浏览器里完成,照片不会上传到任何服务器——这一点对合同、单据、证件这类包含隐私或敏感信息的照片尤其重要,你不需要把这些内容交给一个陌生的第三方服务器。
  3. 识别完成后,每张照片对应一段可复制的文字,也可以直接下载成 .txt 文件;批量识别的话还能一次性打包下载。

如果手头的不是照片而是 PDF 文件(比如扫描件、或者导出时被转成矢量图形导致没有文字层的 PDF),直接用 批量PDF转文字 更合适——遇到没有文字层的情况,它会自动切换到同一套 OCR 引擎处理,不用你自己先转成图片再识别。

识别出来之后

下载前工具会弹出提醒,确认你已经核对过内容——这不是多此一举:OCR 终究是“识别”不是“提取”,尤其是涉及金额、日期、条款这类内容,建议花几十秒对照原照片检查一遍,再拿去用在正式场合。