PDFの無料OCRおすすめ比較(オンライン版・オフライン版)
スキャンPDFを本当に検索可能にできる無料OCRはどれか。オンライン・オフラインの主要な選択肢を比較し、書類の種類ごとに最適なツールを解説します。

OCR(光学文字認識)は、どのページも画像でしかないスキャンPDFを、検索も選択もできる文書に変えます。無料の選択肢は、使い勝手も品質もかなり差があります。ここでは実際のところどうなのかを、正直に比較します。
PDFのOCRとは(どんなときに必要か)
スキャンしたPDFは、見た目は文書でも中身は写真と変わりません。各ページが1枚の大きな画像で、その下に本物のテキストはありません。だからCtrl/Cmd+Fで検索しても何も見つからず、文をドラッグして選択することもできず、PDFをWordに変換するツールも材料がないまま動けません。
この問題を解決するのがOCRです。PDFにOCRをかけると、エンジンが画像を解析して文字の形を認識し、印刷された文字とぴったり重なる位置に、目に見えないテキスト層を各ページの上に書き込みます。処理後もスキャンの見た目はまったく同じですが、中身は普通の文書になります。検索でき、テキストを選択してコピーでき、Wordやプレーンテキストへの変換もできます。
OCRが必要になるのは、PDFがスキャナー・スマホのカメラ・FAXから来たとき、つまり紙を画像として取り込んだ場合です。簡単な見分け方があります。PDF上で単語を選択してみてください。文字がハイライトされず、四角い選択範囲がドラッグされるだけなら、それはスキャンでOCRが必要です。WordやGoogle ドキュメント、Webサイトから直接書き出したPDFにはすでに本物のテキストが入っているので、OCRをかけても何も変わりません。
最近のPDF向けOCRツールは、この流れを1ステップでこなします。スキャンをアップロードし、言語を選び、検索可能なPDFをダウンロードするだけです。ブラウザなら PDF OCR がまさにこれを無料で行います。以下のセクションでは、オンライン・オフラインを問わず、他の無料の選択肢と比べていきます。
すぐわかる結論
| やりたいこと | 無料のおすすめ | 理由 |
|---|---|---|
| インストールせずブラウザで | pdfty OCR | 中身はTesseract。検索可能なPDFが無料で手に入る |
| 完全オフライン(プライバシー重視) | NAPS2 | スキャンもOCRもローカル完結。何もアップロードしない |
| とにかく速くテキストだけ取り出す | Google ドライブ | アップロード → Google ドキュメントで開く → テキストが出る |
| 状態の悪いスキャン・手書き | 有料(ABBYY / Adobe) | 無料エンジンは手書きが苦手 |
なぜTesseractが無料の標準なのか
使う価値のある無料OCRは、そのほとんどがTesseractを土台にしています。Googleの支援を受けて開発が続くオープンソースエンジンで、100以上の言語に対応し、きれいな活字なら非常に高い精度が出ます。しかも本当に無料です(透かしなし、1日あたりの上限なし)。「無料OCRツール」どうしの違いは、認識性能そのものよりも、Tesseractをどう包むかというインターフェースの差だと考えてよいでしょう。
それぞれの選択肢を詳しく
pdfty OCR(ブラウザ、無料)
スキャンPDFをドロップして言語を選ぶだけで、目に見えない本物のテキスト層が入ったPDFをダウンロードできます。インストール不要で、どの端末でも動きます。設定に手間をかけず、すぐ検索可能な状態にしたいときに最適です。
NAPS2(デスクトップ、無料、オープンソース)
Tesseractを内蔵した「スキャナー → PDF」アプリです。すべての処理が自分のマシン内で完結するため、機密文書に向いています。紙のスキャンが日常的にあり、ローカルで閉じたワークフローを組みたい人向けです。
Google ドライブ(無料、ざっくり)
画像やPDFをドライブにアップロードし、右クリックからGoogle ドキュメントで開くを選びます。テキストがOCRされ、新しいドキュメントになります。書式は崩れますし、1ファイルずつしか処理できませんが、無料でインストールも不要です。
有料エンジン(比較のために)
ABBYY FineReaderやAdobe Acrobat ProのOCRは、状態の悪いスキャン、多段組レイアウト、一部の手書きに対して確かに強いです。ただし元が取れるのは、大量処理や低品質な原稿を日常的に扱う場合に限られます。きれいな文書であれば、無料のTesseract系ルートでも実用上は互角です。
OCRの精度を上げるコツ(どのツールでも)
- 300 DPI以上でスキャンする — 解像度の低さが精度に一番響きます。
- ページの傾きを直す — 傾いた文字はどのエンジンでも認識が落ちます。
- コントラストを確保する — 暗い部屋でのスマホ撮影より、明るく均一な照明のほうが確実です。
- 正しい言語を選ぶ — 文書内に含まれるすべての言語を指定してください。
よくある質問
PDFの無料OCRで一番いいのはどれですか?
多くの人にとってはTesseract系のツールです。ブラウザで完結させたいならpdftyのOCR、オフラインで使いたいならNAPS2。どちらも無料で、同じ強力なエンジンを使っています。
無料OCRは手書きにも使えますか?
たいていは無理です。手書きの認識は難易度が高く、無料エンジンは苦手としています。一方、きれいな活字であれば無料OCRでも十分に高い精度が出ます。
OCRをかけるとスキャンの見た目は変わりますか?
変わりません。画像の上に目に見えないテキスト層を追加するだけです。見た目は元と同一のまま、検索と選択ができるようになります。
対応している言語は?
Tesseract系のツールは、日本語・英語・中国語・韓国語・スペイン語・フランス語・ドイツ語・ロシア語・アラビア語など、100以上の言語に対応しています。
機密文書をオンラインOCRにかけても安全ですか?
信頼できるツールはアップロードを暗号化し、ファイルを短時間で削除します(pdftyは1時間以内)。プライバシーを最優先するなら、何もアップロードしないオフラインのNAPS2を使ってください。
pdfty チームはプライバシー重視のオンライン PDF ツール(圧縮・変換・OCR・署名・保護)を開発しています。ファイルは 1 時間以内に削除されます。 私たちについて →
