使用 OCR 让扫描版 PDF 可搜索
扫描版 PDF 只是一组图片:您无法搜索其中内容、选中句子或复制文字。上传一个或多个扫描版 PDF 文件,此工具会识别每一页上的文字(OCR),并将其作为不可见的图层精确叠加在页面文字上方。页面看起来与之前相同,但现在您可以使用 Ctrl+F 搜索、选中和复制文字,文档也能按内容被检索到。
识别支持 30 种语言,对于至少 200–300 dpi 的清晰扫描件效果最佳。已包含文字的页面会被跳过,因此混合文档也能正确处理。文件保存 48 小时后自动删除——您也可以随时自行删除。
为什么使用这款 PDF OCR 工具?
- 在扫描文档中搜索、选中和复制文字
- 页面外观与之前完全相同——文本层不可见
- 30 种识别语言,每份文档可选多种
- 已包含文字的页面保持不变
如何对 PDF 进行 OCR
- 拖放您的扫描版 PDF 文件,或点击选择文件
- 选择文档的语言
- 点击“设为可搜索”,下载可搜索的 PDF
常见问题
这款 PDF OCR 工具免费吗?
是的,让您的扫描版 PDF 文件可搜索完全免费。
OCR 会对我的 PDF 做什么?
OCR(光学字符识别)会读取页面图像中的文字,并将其作为不可见的文本层添加到 PDF 中。扫描页面本身不会改变,因此文档看起来相同,但变得可搜索、可选中。
支持哪些语言?
30 种语言,包括英语、西班牙语、法语、德语、俄语、阿拉伯语、印地语、中文、日语和韩语。选择文档中出现的所有语言可获得最佳效果。
识别的准确度如何?
对于清晰、端正的印刷文字扫描件,识别非常准确。低分辨率、模糊或歪斜的扫描件、手写文字以及不常见的字体会降低准确度。
我的文件会保密吗?
文件通过加密连接传输,并在我们的服务器上处理。上传的文件和结果会保存 48 小时,方便您通过链接下载结果,之后会自动删除。您也可以随时在“您的文件”列表中点击删除按钮自行删除。
文件大小有限制吗?
有,上传的 PDF 文件必须为 1 GB 或更小。