OCR识别

使扫描和基于图像的PDF可搜索和可选择。

点击或拖放扫描的PDF到此处

仅支持PDF · 最大50MB · 处理可能需要一分钟

Or import from cloud

OCR 如何将扫描版 PDF 转换成可搜索文本

我们会将每一页渲染成图片,运行 Tesseract OCR 进行识别,然后在原始图片下方重建一层不可见的文本,生成新的 PDF。页面外观保持不变,但文本现在可以被选中、复制和搜索。

OCR 的识别准确率取决于扫描质量。清晰的 300 DPI 打印文本扫描件识别准确率可接近 99%;褪色的复印件和手写文字识别难度更大。

相关PDF工具

常见问题