OCR PDF
让扫描的 PDF 可搜索:其中的文字变成可以查找和复制的文本。
或把 PDF 文件拖放到这里
留在您的设备上——不上传任何内容如何使用OCR PDF
- 选择您的 PDF 文件。 或拖放到此页面。
- 选择设置。 默认设置适合大多数文件。
- 转换并下载。 结果:PDF。
关于OCR PDF
OCR PDF 让扫描的 PDF 可搜索。它识别每页上的文字,并以不可见的方式放在页面图像上方,方便您搜索、选择和复制。页面外观完全不变。
可识别一百多种语言。请勾选文档所用的语言。
常见问题
我的文件会被上传吗?
不会。PanPDF 在您的浏览器内部处理,文件从不离开您的设备。页面加载完成后,您甚至可以断开网络。
免费吗?
是的,无需账户、没有水印、没有每日限制。PanPDF 是开源软件。
会下载什么?
开始时,会从本站下载识别程序(约 3 MB)和您勾选的语言文件(大多数每个 1 到 3 MB)。它们只在页面打开期间保留,离开页面后即被清除。您的 PDF 不会被发送到任何地方。
准确度如何?
这是一个非常小的模型,可能会识别错误;使用前请检查文字。在清晰的印刷页面上,我们测得英文约每 250 个字符错 1 个,泰文约每 30 个错 1 个,老挝文约每 9 个错 1 个。倾斜、昏暗或模糊的照片识别效果更差。
由什么识别文字?
Tesseract OCR,由 tesseract.js-core 编译为浏览器版本,配合 tessdata_fast 语言模型。三者均以 Apache License 2.0 开源。PanPDF 桌面程序也使用同一个 Tesseract 识别文字。
能识别哪些语言?
一百多种,从英语、西班牙语和法语到阿拉伯语、印地语、中文和日语。在列表中搜索并勾选文档所用的语言。
能在手机上用吗?
可以。这些工具可在任何现代浏览器中运行,手机、平板或电脑都行,无需安装任何东西。
我的 PDF 有密码。
在提示时输入。仅禁止打印或复制的文件无需密码即可转换。