PDF OCR

スキャンPDFや画像内の文字までブラウザ内で認識し、テキストとして保存できます。

PDF内の選択可能な文字だけを取り出す場合は、 PDFテキスト抽出 をご利用ください。

  • 登録不要
  • インストール不要
  • ブラウザ内で処理

ファイルはこの端末内にとどまります サーバーへアップロードせず、このブラウザ内で処理します。

ファイルの扱いを見る

まだファイルが選択されていません。

OCRモデル

言語ごとに別モデルを読み込む方式ではありません。選んだモデルの多言語辞書で読み取り、初回のみモデルをこのサイトから読み込みます。

最大40ファイル / 1ファイル120MBまで

結果

読み取ったテキストのプレビューとTXTダウンロードをここに表示します。

使い方

  1. PDFまたは画像を選択します。
  2. 必要に応じて読み取るページ範囲とOCRモデルを選びます。
  3. OCR結果を確認し、TXTファイルをダウンロードします。

対応ファイルと注意点

  • 対応形式: PDF、JPG、JPEG、PNG、WebP
  • 上限: 1ファイル120MB、最大40ページまたは40画像
  • 対応文字: 日本語、英語、中国語、繁体字中国語。v6モデルは多くのラテン系言語にも対応します。
  • OCRモデル: 高速 v6 Tiny 約6.0MiB、標準 v5 約20.5MiB、高品質 v6 Small 約29.8MiB

ご利用前の確認

  • OCR結果は完全ではありません。提出、契約、請求などに使う前に必ず内容を確認してください。
  • 文字が小さい、傾いている、低解像度、手書き、背景が濃い画像では認識精度が下がります。
  • 初回はOCRモデルの読み込みに時間がかかります。
  • 大きなPDFや複雑なPDFでは、処理に時間がかかる場合があります。
  • 重要なファイルは、元ファイルのバックアップを残してから処理してください。

PDF OCR FAQ

スキャンPDFの文字を抽出できますか?

はい。画像として保存されたスキャンPDFをページごとにOCRし、読み取った文字をTXTで保存できます。PDF内の選択可能な文字だけを取り出したい場合は、PDFテキスト抽出をご利用ください。

OCR結果は正確ですか?

文字の大きさ、解像度、傾き、背景、フォントによって精度が変わります。重要な用途では必ず目視で確認してください。

PDFや画像はアップロードされますか?

いいえ。OCR処理はブラウザ内で行います。OCRモデルはサイトから読み込みますが、選択ファイルはサーバーへ送信しません。