MRS ブログ

スキャンしたPDFを文字検索できるようにする:OCR、テキストレイヤー、iPhoneでの手順

公開日 · 12分で読めます
明るい机の上で印刷された紙の上にiPhoneをかざす手と、紙の上を横切る細いシアンの光のライン

PDFを検索可能にするにはどうすればいいですか?

PDFを検索可能にするには、OCR(光学文字認識)をかけます。OCRはページ画像の文字を読み取り、見えないテキストレイヤーを追加するため、見た目はそのままで検索・選択・コピーができるようになります。パソコンではAdobe Acrobatの「Recognize text」で、iPhoneではMRSがスキャンや写真のページごとに端末上でテキストレイヤーを追加します。

ポイント

  • OCRをかけていないスキャンPDFは画像なので、検索・選択・コピーの対象になる文字がありません。
  • OCRはページ画像の下に見えないテキストレイヤーを追加します。見た目は変わらず、文字が検索できるようになります。
  • どのPDFも30秒で確認できます。単語を選択してみて、次にページの中ほどにある単語を検索します。
  • パソコンではAdobe Acrobatの「Scan & OCR」ツールで文字を認識できます。無料のオンライン版はファイルをAdobeのサーバーにアップロードします。
  • iPhoneのMRSは、新しいスキャンと写真のすべてのページに端末上でテキストレイヤーを追加します。アップロードは不要です。

スキャンした賃貸契約書の検索ボックスに「敷金」と入力しても、2ページ目にその言葉がはっきり書かれているのに、PDFは検索結果0件と答えます。このファイルは紙を撮った写真なので、検索できる文字がないのです。このガイドでは、OCRでPDFを検索可能にする方法、OCRとは何かをわかりやすく説明し、iPhoneで検索可能なPDFを作るいちばん早い方法を紹介します。

スキャンしたPDFが検索できない理由

スキャンしたPDFは、各ページを画像として保存しています。PDFに関するWikipediaの記事でも、OCRで文字を認識せずにPDF化した文書は、フォントやテキストの情報を持たない画像にすぎないと明確に説明されています(PDF, Wikipedia)。人の目には文字が読めても、PDFビューアーには色のついたピクセルしか見えません。

この違いは、小さな場面で時間を奪います。12ページの契約書から「解約」を検索できない、銀行からの書類の口座番号をコピーできない、店名を入力しても書類アプリがレシートを見つけられない、といったことが起こります。

OCRとは?テキストレイヤーとは?

OCR(光学文字認識)とは、タイプされた文字、手書き文字、印刷された文字の画像を、機械が扱えるテキストに電子的または機械的に変換する技術です(Optical character recognition, Wikipedia)。ソフトウェアはページ画像の中から文字の形を見つけ、認識した言葉を書き出します。

検索可能なPDFは、各ページに2つのものを持っています。目に見える元の画像と、その下の同じ位置に置かれた認識済みのテキストです。同じWikipediaの記事では、これを元のページ画像と検索可能なテキスト表現の両方を含むPDFと説明しています。テキストは見えないのでページの見た目は変わりませんが、検索・選択・コピーができるようになります。

明るい机の上の印刷された紙を細いシアンの光のラインが横切り、その隣に画面が暗いiPhoneがある様子
明るい机の上の印刷された紙を細いシアンの光のラインが横切り、その隣に画面が暗いiPhoneがある様子

PDFを検索可能にする手順

どの方法がよいかは、1つの質問で決まります。紙はまだ手元にありますか、それともファイルだけですか?紙があれば1分でOCR付きのスキャンをやり直せます。ファイルしかないPDFには、パソコンかオンラインのOCRツールが必要です。

  1. まずファイルを確認します。 PDFを開き、単語を長押しするか、行をドラッグします。単語がハイライトされ、検索で見つかれば、そのファイルはすでに検索可能なので、ここで終わりです。
  2. OCRを使って紙をスキャンし直します。 MRSで「書類をスキャン」をタップし、iPhoneをページの上にかざして、カメラに端を検出させて撮影します。MRSは、Appleの文字認識を高精度モードと言語の自動検出で使い、スキャンのすべてのページにiPhone上で見えないテキストレイヤーを追加します。
  3. ページの写真をPDFにします。 紙ではなく写真がある場合は、MRSで「写真を読み込む」を使います。写真のページにもスキャンと同じテキストレイヤーが追加されます。先にトリミングする方法は写真をPDFにするガイドで説明しています。
  4. パソコンで既存のPDFにOCRをかけます。 デスクトップ版Adobe Acrobatでは、Adobeのガイドに手順が載っています。スキャンを開き、"All tools"、"Scan & OCR"、"In this file"、"Recognize text"の順に選びます(Adobe Experience League)。処理が終わったらファイルを保存します。
  5. 結果を確認します。 OCRの誤りが隠れやすい2ページ目や3ページ目の中ほどにある単語を検索します。次に1行をコピーして「メモ」に貼り付け、テキストがどれだけ正確か確認します。
  6. PDFに名前を付けて整理します。 あとで検索しそうな名前(「賃貸契約 2026 桜町」など)を付けて、フォルダに移動します。中の文字で検索できるのは安全網で、わかりやすいタイトルがあれば今でもいちばん早くファイルが見つかります。

MRSでスキャン・署名・検索

自動で端を検出するスキャナ、検索できるPDFを作る文字認識(OCR)、PDF編集、保存した署名をiPhoneで。ページは端末内に保存されます。

よくある誤解:OCRで文字が編集できるようにはならない

OCRはPDFを検索可能にしますが、スキャンをWord文書に変えるわけではありません。ページは画像のままで、認識した文字は検索とコピーのためにその下に置かれます。ページの上に自分で文字や日付、署名を加えたい場合は、PDF編集の基本ガイドで紹介しているように編集機能を使います。

パソコン、オンライン、iPhoneのOCRを比較

検索可能なPDFを作る一般的な方法は3つあり、大きな違いはファイルがどこに送られるか、新しいページごとにどれだけ手間がかかるかです。Adobeに関する情報は、執筆時点のAdobe自身のページによるものです。

方法実行する場所料金プライバシー多数のページやファイル
Adobe Acrobatデスクトップ版("Scan & OCR"、"Recognize text")MacまたはPCのAcrobatアプリAcrobatの有料サブスクリプションデスクトップアプリで開いたファイルを処理開いているファイルの全ページを認識("In this file")
Adobe AcrobatオンラインOCRWebブラウザ無料で実行可能。結果のダウンロードにはサインインが必要アップロード:Adobeによると、ファイルはAdobeのサーバーで処理され、サインインして保存しない限り削除される複数ページのPDFに対応、1回に1ファイルずつアップロード
iPhoneのMRSiPhone上(iOS 16以降、iPhoneのみ)無料でダウンロード。スキャンとOCRは無料。MRSプレミアムで共有と保存済み書類の無制限の閲覧が可能(価格はアプリ内に表示)端末上:アップロードなし、アカウント不要新しいスキャンと写真の全ページで自動。読み込んだPDFは処理しない

オンライン版の情報はAdobeのOCR PDFのページによるものです。

どの方法が合っていますか?

手元にある紙で決まります。新しい賃貸契約書、レシート、学校の書類なら、MRSでスキャンすればPDFとテキストレイヤーが一度に作られ、ページがスマホの外に出ることもありません。メールで届いた古いスキャンPDFで元の紙がない場合は、Acrobatの入ったパソコンが現実的な方法で、アップロードが気にならなければオンラインツールも使えます。

OCRでページを正しく読み取るコツ

OCRの精度はスキャンの品質に左右されます。Appleは高精度の認識レベルについて、時間はかかるものの、より網羅的な結果を出すと説明しています(Apple Developer Documentation)。MRSはこのレベルを使っていますが、どれほど丁寧なソフトウェアでも、カメラが捉えなかったものは読めません。

  • ページを平らにします。 丸まったページでは文字の行が曲がり、折り目の近くの文字が誤認識されます。フレームの外側で、本や手で端を押さえます。
  • 均一な光を当てます。 スマホの影が紙に落ちる天井の照明より、窓からの自然光のほうが適しています。
  • 画面いっぱいに写します。 ページが画面の大部分を占めるようにスマホを構えます。遠くのページの小さな文字は、1文字あたり数ピクセルになってしまいます。
  • 1つのPDFに1つの書類をスキャンします。 3ページの賃貸契約書は1つのファイルに、レシートは別のファイルに分けると、検索結果がすっきりします。

スキャンのガイドでは、光、角度、カラーモードについてさらに詳しく説明しています。

窓際の白い机の上で、少し丸まった紙を手で平らにのばし、その横にiPhoneが置かれている様子
窓際の白い机の上で、少し丸まった紙を手で平らにのばし、その横にiPhoneが置かれている様子

色あせたレシートと手書き文字のルール

色あせた感熱紙のレシートと手書き文字は、どのアプリを使ってもOCRの読み取りが悪くなる2つのケースです。Wikipediaによると、筆記体の手書き文字の認識率は、手書きの活字体より低くなります。色あせていくレシートは受け取った日に明るい場所でスキャンし、手書きのメモには検索に使う言葉をPDFのタイトルに入れておきます。テキストレイヤーがその言葉を拾えないことがあるためです。

PDFが検索可能か確認する方法

検索可能なPDFは、4つの簡単なテストに合格します。どれもPDFアプリで数秒で確認できます。

  • 選択テスト: 単語を長押しすると、ハイライトされますか?ハイライトされなければ、テキストレイヤーはありません。
  • 検索テスト: 2ページ目の中ほどにある単語を検索して見つかりますか?見出しの言葉がいちばん簡単で、本文の言葉が見つかればページ全体が読み取られた証拠です。
  • コピーテスト: 1行をコピーして「メモ」に貼り付けたとき、普通の文章として読めますか?数文字の誤りはよくあることですが、記号ばかりの行はスキャンの品質が悪いことを示します。
  • ライブラリテスト: MRSで、書類の中にしか出てこない言葉(大家さんの名字など)を入力したとき、「ライブラリ」の検索でその書類が見つかりますか?

3つの言葉で試す30秒テスト

検索する前に3つの言葉を選びます。タイトル付近から1つ、ページの中ほどから1つ、下のほうの小さな文字から1つです。それぞれ検索します。3つとも見つかればテキストレイヤーは良好です。小さな文字が見つからなければ、そのページをもっと近づけて、明るい場所でスキャンし直します。

よくある失敗と注意点

検索がうまくいかない原因の多くは、いくつかの習慣にあります。どれもすぐに直せます。

  • 失敗:読み込んだPDFが検索可能になると思い込む。 MRSは読み込んだPDFをそのままのデータで保存し、OCRはかけません。紙がまだあればスキャンし直し、写真があれば「写真を読み込む」を使います。
  • 失敗:正確な数字をOCRに任せきりにする。 ぼやけたページでは、5がS、8がBと読まれることがあります。合計金額、口座番号、日付は、フォームにコピーする前に画像と見比べて確認します。
  • 失敗:斜めの角度で、影があるままスキャンする。 傾いた暗いページでは、認識される文字が崩れます。スキャナーに端を検出させ、均一な光の場所に移動します。
  • 失敗:ファイル名を「スキャン 12」にする。 中身での検索も役立ちますが、あなたもどのアプリも最初に検索するのはわかりやすいタイトルです。

MRSの古いスキャンと読み込んだPDF

OCR対応のアップデートより前にMRSでスキャンした書類にはテキストレイヤーがないため、「ライブラリ」の検索ではタイトルでしか見つかりません。MRSはこれらをまとめて処理し直すことはしないので、よく検索する書類はスキャンし直してください。「ファイル」アプリから読み込んだPDFは届いたときのままです。これまでどおり開く、署名する、共有することができ、MRSがテキストレイヤーを追加することはありません。

検索可能なPDFのチェックリストと次のステップ

スキャンを保管する前に、次の項目を確認します。

  • 確認済み: 単語を選択し、本文中の単語を検索しました。
  • 平らに明るくスキャン: 丸まりもスマホの影もなく、ページが画面いっぱいに写っています。
  • 数字を確認済み: 合計金額、日付、口座番号が画像と一致しています。
  • わかりやすい名前: あとで入力する言葉がタイトルに入っています。
  • 整理済み: PDFが、自分の考え方に合ったフォルダに入っています。

スマホでのスキャンは初めてですか?基本はiPhoneで書類をスキャンするガイドで、箱いっぱいの書類を片付ける方法は週末でペーパーレス化するプランで、多くのスキャンの次の作業になる署名は署名のガイドで紹介しています。新しいスキャンを最初のページから検索可能にするには、MRSをダウンロードしてください。アプリについてのご質問はサポートまでどうぞ。

よくある質問

OCRとは簡単に言うと何ですか?

OCR(光学文字認識)は、文字が写った画像を読み取り、コンピューターが検索やコピーをできる本物のテキストに変換するソフトウェアです。PDFでは、その結果がページ画像の下にある見えないレイヤーとして保存されます。

PDFがすでに検索可能かどうかは、どう確認できますか?

PDFを開き、単語を長押し(またはドラッグ)します。単語を選択でき、ページの中ほどにある単語を検索して見つかれば、そのPDFにはテキストレイヤーがあります。何もハイライトされなければ、ページは画像だけです。

OCRをかけるとPDFの見た目は変わりますか?

変わりません。検索可能なPDFは元のページ画像を上に残し、認識したテキストを見えないレイヤーに入れます。表示されるのは同じスキャンで、検索とコピーには隠れたテキストが使われます。

iPhoneでPDFを検索可能にできますか?

はい、紙をスキャンするか、紙の写真を読み込む場合にできます。MRSはスキャンと写真のすべてのページでAppleの文字認識をiPhone上で実行し、見えないテキストレイヤーをPDFに保存します。「ファイル」アプリから読み込んだPDFにはOCRをかけず、データはそのまま保たれます。

OCRで一部の単語が間違って認識されるのはなぜですか?

OCRは画像から1文字ずつ推測しています。ぼやけ、影、丸まったページ、色あせた感熱紙のレシート、珍しいフォント、手書き文字は、どれも推測の精度を下げます。平らで明るく、ピントの合ったスキャンが最もよい結果になります。

関連する記事

すべての記事 →