PanPDF

OCR PDF

スキャンした PDF を検索可能に:文字が、検索もコピーもできるテキストになります。

または PDF ファイルをここにドロップ

あなたの端末に残ります — アップロードはありません

OCR PDF の使い方

  1. PDF ファイルを選んでください。 またはページにドロップしてください。
  2. 設定を選ぶ。 ほとんどのファイルは既定の設定で問題ありません。
  3. 変換してダウンロード。 結果:PDF。

OCR PDF について

OCR PDF は、スキャンした PDF を検索可能にします。各ページの文字を読み取り、見えない文字としてページの画像の上に配置するので、検索・選択・コピーができます。ページの見た目はまったく変わりません。

100 以上の言語を読み取れます。文書に使われている言語にチェックを入れてください。

よくある質問

ファイルはアップロードされますか?

いいえ。PanPDF はブラウザの中で処理するので、ファイルが端末の外に出ることはありません。ページを読み込んだ後はインターネットを切っても使えます。

無料ですか?

はい。アカウント不要、透かしなし、1 日の回数制限もありません。PanPDF はオープンソースです。

何をダウンロードしますか?

開始時に、このサイトから読み取りエンジン(約 3 MB)とチェックした言語のファイル(ほとんどは 1 つ 1〜3 MB)をダウンロードします。ページを開いている間だけ保持され、離れると消えます。PDF がどこかへ送られることはありません。

精度はどのくらいですか?

とても小さなモデルなので、読み間違えることがあります。使う前に文字を確認してください。鮮明な印刷ページでは、英語で約 250 文字に 1 文字、タイ語で約 30 文字に 1 文字、ラオ語で約 9 文字に 1 文字の誤りを測定しました。傾いた写真、暗い写真、ぼやけた写真は精度が下がります。

文字は何が読み取りますか?

Tesseract OCR を tesseract.js-core がブラウザ向けにコンパイルしたもので、tessdata_fast の言語モデルを使います。3 つとも Apache License 2.0 のオープンソースです。PanPDF のデスクトップ版も同じ Tesseract で文字を読み取ります。

どの言語を読み取れますか?

英語、スペイン語、フランス語からアラビア語、ヒンディー語、中国語、日本語まで、100 以上。リストを検索して、文書の言語にチェックを入れてください。

スマートフォンでも使えますか?

はい。ツールはスマートフォン、タブレット、パソコンのどれでも、最新のブラウザならインストールなしで動きます。

PDF にパスワードがかかっています。

求められたら入力してください。印刷やコピーを禁止しているだけのファイルは、パスワードなしで変換できます。