コンテンツへスキップ
PDFToucan PDF Toucan ホーム

PDF OCR

スキャンしたPDFの文字を認識し、検索やコピーができるテキスト付きのPDFファイルに変換します。

またはファイルをここにドロップ

PDF OCR

PDF OCRは、サーバー上でスキャンPDFを検索可能なテキスト付きPDFに変換する処理です。文書が画像として保存されていて文字検索ができない場合に役立ちます。1つまたは複数のファイルを追加し、文書で使用されている言語を選択して処理を完了すると、検索可能なPDFをダウンロードできます。Wordへの直接変換ではなく、PDF形式のまま文字情報を追加して出力します。

PDF OCRでできること

  • スキャンPDFを検索・コピー可能にする

    画像として保存された文字を認識し、PDF内で検索やコピーができるテキストとして追加します。過去の紙資料やスキャンしたノートなど、手作業で入力し直すことなく内容を確認したい文書に最適です。処理後すぐに文字を検索・コピーできるようになります。

  • 文書で使う言語を選んで認識する

    日本語、英語、中国語、韓国語など30言語に対応し、文書で使用されている言語を選択してください。複数の言語が混在している場合は、最大5言語まで組み合わせて選べます。言語を追加すると処理が遅くなるため、必要な言語のみを指定してください。

  • 文字がないページだけをOCR処理する

    おすすめの設定である「文字のないページのみスキャン」を使用すると、すでに選択できる文字があるページはそのまま保持されます。テキスト付きのページとスキャン画像が混在するPDFファイルで、既存のデータを壊さずに文字認識を追加できる実用的な方法です。

  • 既存テキストを再認識して読み直す

    すでに文字が選択できるものの、認識精度の低い古い文字が含まれている場合は「既存の文字を再認識する」を選びます。古い文字を削除し、ページを再度読み取ります。「すべてのページを画像として処理」を選んで最初から認識し直すことも可能ですが、既存の選択可能な文字やリンクは失われます。

  • 傾きや向きを補正してから認識する

    ページの補正機能を使うと、斜めにスキャンされたページをまっすぐに補正し、上下逆さまや横向きにスキャンされたページを正しい向きに自動修正できます。ただし、既存の文字を再認識する場合は傾き補正を使用できません。

  • 複数のPDFを個別の検索可能PDFにする

    複数のファイルをまとめて追加しても、各ファイルは個別に処理されます。文字認識が完了した後は、結合されることなく元のファイル構成を保ったまま、それぞれ個別の検索可能なPDFとしてダウンロードできます。

オンラインでPDF OCRする方法

オンラインでPDF OCRする方法
  1. スキャンしたPDFを追加する

    「PDFファイルを選択」を押して、文字認識したいファイルを追加します。複数のPDFを一度に選択でき、各ファイルは個別に処理されます。検索やコピーができるようにしたいスキャン文書を用意してください。

  2. 文書で使われている言語を選ぶ

    処理を始める前に、文書で使用されている言語を1つ以上選択してください。日本語と英語の契約書など、ページ内に含まれる言語を最大5つまで指定できます。言語を追加すると処理に時間がかかるため、必要なものだけに絞ります。

  3. OCR処理するページを指定する

    すでに文字があるページはそのままにする「文字のないページのみスキャン」を推奨します。古い認識結果が間違っている場合のみ「既存の文字を再認識する」を選んでください。すべてを最初から読み直す場合は全ページを画像として処理します。

  4. 傾きとページの向きを補正する

    傾いたページをまっすぐにする設定や、ページの向きを自動修正する設定を選びます。準備ができたら「文字を認識」を押して開始します。ページ数の多いファイルや複数言語を選んだ場合は、文字認識に数分かかることがあります。

  5. 検索可能なPDFをダウンロードする

    処理が完了すると「文字を認識しました!」と表示されます。検索可能なPDFをダウンロードして保存してください。なお、PDF内の文字を変更する処理の性質上、元のファイルにあったデジタル署名は無効になりましたと表示されます。

サーバーでの処理と短いファイル保持期間

PDF ToucanのPDF OCRは、欧州連合(EU)域内のサーバーで実行されます。ファイルはHTTPS経由で安全に送信され、メモリ上で処理されます。ディスクに書き込まれたり保存されたりすることはなく、結果のダウンロード後すぐに、遅くとも10分以内に削除されます。登録不要で透かしも追加されず、無料で利用できます。サイトの運営は広告によって支えられています。なお、OCR処理によってファイルの内容が変更されるため、既存のデジタル署名は無効になります。

欧州連合のサーバー上でメモリ内処理されます。ファイルは保存されず、結果をダウンロードすると同時に(最長10分後には)削除されます。

PDF OCR – よくある質問

どのようにPDF OCRを実行すればよいですか?

スキャンしたファイルを追加し、文書で使用されている言語と対象ページを選んでから文字認識を開始します。処理が終わったら検索可能なPDFをダウンロードしてください。これでPDF内の文字を検索・コピーできるようになりました。

無料でPDF OCRを利用できますか?

はい、アカウント登録不要の無料オンラインツールとして利用できます。ファイルを追加してオプションを設定するだけで、透かしのない検索可能なPDFを作成できます。ページ数が多い場合や複数言語を選んだ場合は数分かかることがあります。

スキャンしたPDFを検索可能にする方法はありますか?

はい、このツールを使えば無料で検索可能にできます。ファイルを選択し、文書の言語を指定して認識を実行するだけです。出力結果はPDF形式のまま維持され、検索や選択、コピーが可能なテキストが追加されます。

日本語と英語が混在するPDFも処理できますか?

はい、日本語や英語を含む30言語から、文書で使用されている言語を最大5つまで同時に選択できます。ただし、言語を追加すると処理が遅くなるため、実際にページに含まれている必要な言語だけを選ぶようにしてください。

すでに選択できる文字があるページは変わりますか?

おすすめ設定である「文字のないページのみスキャン」を選べば変わりません。すでに文字があるページはそのままにし、文字のないページだけを処理します。再認識や全ページの画像化を選んだ場合は、既存の文字が削除されます。

文字認識後にデジタル署名が無効になるのはなぜですか?

文字認識によってPDFファイルにテキストデータが追加され、元の文書から内容が変更されるためです。変更が加わると既存のデジタル署名は一致しなくなります。署名の有効性を保つ必要がある場合は、元のファイルを別途保管してください。

出力されたPDFをWordに変換できますか?

はい、出力結果はPDF形式となりますが、Word形式が必要な場合はPDF Toucanのpdf-to-wordをご利用ください。まずこのツールでテキストを抽出可能な状態にし、その後に指定のツールで処理を行います。

スキャンした文書をオンラインで検索可能にし、そのままPDFとしてダウンロードしたい場合はPDF OCRをご利用ください。文字認識後にWord形式が必要な場合は、検索可能になったファイルをpdf-to-wordで処理できます。また、テキスト追加によってファイルサイズが大きくなった場合は、共有や保存の前にcompressを使ってサイズを小さくすることをおすすめします。

最終更新日: 2026年9月19日

このツールのガイド