使扫描和基于图像的PDF可搜索和可选择。
点击或拖放扫描的PDF到此处
仅支持PDF · 最大50MB · 处理可能需要一分钟
我们会将每一页渲染成图片,运行 Tesseract OCR 进行识别,然后在原始图片下方重建一层不可见的文本,生成新的 PDF。页面外观保持不变,但文本现在可以被选中、复制和搜索。
OCR 的识别准确率取决于扫描质量。清晰的 300 DPI 打印文本扫描件识别准确率可接近 99%;褪色的复印件和手写文字识别难度更大。
压缩PDF
在不损失质量的情况下减小文件大小。
修复PDF
立即修复损坏或损毁的PDF文件。
PDF扁平化
将表单和注释嵌入静态页面内容。
字数统计
统计任意 PDF 中的字数、字符数、句子数等。