OCR PDF
スキャンした PDF を検索可能に:文字が、検索もコピーもできるテキストになります。
または PDF ファイルをここにドロップ
あなたの端末に残ります — アップロードはありませんOCR PDF の使い方
- PDF ファイルを選んでください。 またはページにドロップしてください。
- 設定を選ぶ。 ほとんどのファイルは既定の設定で問題ありません。
- 変換してダウンロード。 結果:PDF。
OCR PDF について
OCR PDF は、スキャンした PDF を検索可能にします。各ページの文字を読み取り、見えない文字としてページの画像の上に配置するので、検索・選択・コピーができます。ページの見た目はまったく変わりません。
100 以上の言語を読み取れます。文書に使われている言語にチェックを入れてください。
よくある質問
ファイルはアップロードされますか?
いいえ。PanPDF はブラウザの中で処理するので、ファイルが端末の外に出ることはありません。ページを読み込んだ後はインターネットを切っても使えます。
無料ですか?
はい。アカウント不要、透かしなし、1 日の回数制限もありません。PanPDF はオープンソースです。
何をダウンロードしますか?
開始時に、このサイトから読み取りエンジン(約 3 MB)とチェックした言語のファイル(ほとんどは 1 つ 1〜3 MB)をダウンロードします。ページを開いている間だけ保持され、離れると消えます。PDF がどこかへ送られることはありません。
精度はどのくらいですか?
とても小さなモデルなので、読み間違えることがあります。使う前に文字を確認してください。鮮明な印刷ページでは、英語で約 250 文字に 1 文字、タイ語で約 30 文字に 1 文字、ラオ語で約 9 文字に 1 文字の誤りを測定しました。傾いた写真、暗い写真、ぼやけた写真は精度が下がります。
文字は何が読み取りますか?
Tesseract OCR を tesseract.js-core がブラウザ向けにコンパイルしたもので、tessdata_fast の言語モデルを使います。3 つとも Apache License 2.0 のオープンソースです。PanPDF のデスクトップ版も同じ Tesseract で文字を読み取ります。
どの言語を読み取れますか?
英語、スペイン語、フランス語からアラビア語、ヒンディー語、中国語、日本語まで、100 以上。リストを検索して、文書の言語にチェックを入れてください。
スマートフォンでも使えますか?
はい。ツールはスマートフォン、タブレット、パソコンのどれでも、最新のブラウザならインストールなしで動きます。
PDF にパスワードがかかっています。
求められたら入力してください。印刷やコピーを禁止しているだけのファイルは、パスワードなしで変換できます。