支持哪些文件类型?
常见图片格式(JPG/PNG/WebP/HEIC等,iPhone拍照格式也支持)和PDF文件都可以。不过如果手头是PDF,更建议用「PDF转文字」——那个工具会先尝试直接读取文字层(几乎秒出结果、完全准确),没有文字层的页才会自动切到OCR;这个工具对PDF不做区分,一律逐页OCR,速度更慢,准确率也不如有文字层时的直接提取。这里更适合处理没有PDF形式的图片,比如手机拍的文档照片、截图。
识别准确率怎么样?
取决于原图清晰度和排版复杂度——印刷体、清晰的文档照片识别准确率高;手写字、模糊/倾斜/光线不好的照片,或者版式复杂的表格,准确率会明显下降。这个工具适合快速把文字内容拿出来,不保证100%准确,重要内容建议识别后自己核对一遍。
识别一张图/一页要多久?
普通笔记本电脑上,一页/一张大概1-3秒,具体取决于图片分辨率和文字量。第一次使用需要先下载识别引擎(约十几MB,只需一次,浏览器会缓存),之后处理速度不受影响。
图片或PDF会上传到服务器吗?
不会。识别全程在你的浏览器本地完成(下载的识别引擎也是在本地运行),文件内容不会发送到任何服务器,关掉页面就什么都不会留下。