PDF OCR認識
無料 ローカル処理無料オンラインPDF OCRテキスト認識ツール。PDFの各ページを画像にレンダリング後tesseract.jsでテキスト認識。簡繁中国語、英語、日本語、韓国語、フランス語、ドイツ語、スペイン語など10+言語に対応、ページ範囲指定可能。ファイルはアップロードされず、すべてブラウザ側で処理、プライバシー保護。
ファイルをここにドラッグ、または
各ファイル最大 100.0 MB
オプション
使い方
- 1 PDFファイルを1つ選択
- 2 認識言語を選択(簡繁中国語、英語、日韓仏独西露アラビアなど10+言語に対応)
- 3 オプション:ページ範囲を入力(例:1-3)、空欄は全ページ認識
- 4 「PDF OCR認識」ボタンをクリック、認識完了後テキストを確認/コピー
FAQ
Q: なぜこんなに遅いのですか?
OCRは各ページを高解像度画像にレンダリングしてから1ページずつテキスト認識するため計算量が多い。ページ数が多いほど、解像度が高いほど遅くなります。「ページ範囲」で必要なページのみ認識、またはメモリを消費する他のタブを閉じることを推奨。
Q: 認識精度が高くない場合は?
精度はPDFの鮮明度に依存。スキャン文書が鮮明でフォントが整然している場合は良好、ぼやけや傾き、手書きは効果が劣ります。より適合する言語を選択(純英語は「英語のみ」でより精度が高い場合あり)。
Q: ファイルはサーバーにアップロードされますか?
いいえ。すべてのレンダリングと認識はブラウザで完了、ファイルはデバイスから離れず、プライバシーを完全に保護します。