手机拍的合同/单据照片,文字怎么变成可编辑文本(不用一个字一个字打)
手机拍了一份合同条款、一张发票、白板上的会议笔记,想把里面的文字发给同事、存进文档、或者翻译成另一种语言——第一反应通常是“复制一下就行”。结果长按屏幕、框选,什么都选不中,因为这终究只是一张照片,不是一段文字。
要么对着照片一个字一个字往外敲,要么找个工具“识别”出来。后者显然更省事,但具体怎么操作、识别出来靠不靠谱、会不会把照片传到什么服务器上——这篇一次说清楚。
为什么照片里的字不能直接复制
对电脑/手机来说,一张照片就是一堆像素点,不管这些像素排列起来在人眼看来像不像“字”,文件本身并不知道“这里写的是什么字”。想要复制粘贴,前提是这段内容以“字符”的形式存在,而不是“像素”——这就是为什么 Word 文档里的文字能直接选中,照片里的“文字”不能。
要把像素变成字符,需要 OCR(光学字符识别)——本质上是让程序“看图识字”,跟人眼认字是同一件事,只是换成了机器来做。
识别效果怎么样,能信到什么程度
先说实话:OCR 不是 100% 准确的技术,识别效果和照片本身的质量强相关。
- 表现好的情况:印刷体、光线均匀、字迹清晰不模糊、没有明显倾斜的照片——这类照片识别准确率相当高,中英文都支持。
- 容易出错的情况:手写字迹、模糊/暗光/歪斜拍摄的照片、密集的表格,识别错误率会明显上升,常见问题是个别字认错、下划线或方框这类格式还原不完全。
所以 OCR 识别结果适合当作“起点”——省掉从头手打的功夫,但不适合直接当“终点”直接使用。尤其是照片里有金额、日期、合同条款、证件号码这类关键信息时,识别完务必对照原照片核对一遍再用,别直接复制粘贴就发出去了。
怎么把照片里的文字提取出来
- 打开 图片/扫描件转文字(OCR),把要识别的照片拖进去——支持一次拖多张,不用一张一张来。
- 点击“开始识别”。整个识别过程在你自己的浏览器里完成,照片不会上传到任何服务器——这一点对合同、单据、证件这类包含隐私或敏感信息的照片尤其重要,你不需要把这些内容交给一个陌生的第三方服务器。
- 识别完成后,每张照片对应一段可复制的文字,也可以直接下载成 .txt 文件;批量识别的话还能一次性打包下载。
如果手头的不是照片而是 PDF 文件(比如扫描件、或者导出时被转成矢量图形导致没有文字层的 PDF),直接用 批量PDF转文字 更合适——遇到没有文字层的情况,它会自动切换到同一套 OCR 引擎处理,不用你自己先转成图片再识别。
识别出来之后
下载前工具会弹出提醒,确认你已经核对过内容——这不是多此一举:OCR 终究是“识别”不是“提取”,尤其是涉及金额、日期、条款这类内容,建议花几十秒对照原照片检查一遍,再拿去用在正式场合。