本文へ移動

PDFを画像にする?文字を取り出す?目的に合う変換方法

PDFページ全体の画像、内部に埋め込まれた元の写真、編集できる文字は、それぞれ別の結果です。必要なものに合わせて操作を選びましょう。

公開日 更新日 約4分で読めます

この記事のポイント

  • PDFからJPG・PNGへの変換はページ全体を画像にします。
  • 必要なページと解像度だけを選びます。
  • スキャンPDFを画像にしても検索できる文字層は付きません。
  • スキャンの文字が必要なら、ページをPNGに保存してから適切な言語でOCRを使います。

PDFには文字、ベクトル、写真が入っている場合も、スキャン画像だけの場合もあります。まずPDF閲覧アプリで文字を選択できるか試してください。すでにコピーできるかもしれません。

このサイトは選択したファイルを端末内で処理し、ページや画像に関する個別の作業を行います。PDF本文の本格的な編集、安全な墨消し、電子署名の機能はありません。

スキャンした文書から、画像と編集可能なテキスト文書へ分かれる変換の図。

必要な結果から操作を選ぶ

目的適した操作得られないもの
ページ全体を写真形式にするPDFをJPGに変換埋め込まれた元写真の無変更抽出
文字や図表のページを画像にするPDFをPNGに変換検索できる文字層
スキャンから文字をコピーするPNG保存後にOCRレイアウトを保つWord文書
一部のページだけを渡すPDFを分割ページのラスター画像

PDFのままでよければ、不要な画像化を避けられます。PDFを分割やPDFページを整理なら、内容をピクセルに変えずに文書を準備できます。

JPGとPNGを使い分ける

PDFをJPGに変換は、写真の多いページや小さいファイルでの共有に向くことがあります。ただしJPEG圧縮で細い文字や輪郭が変わる場合があります。PDFをPNGに変換はその非可逆圧縮を避けられますが、容量が増えることがあります。

どちらもページ全体を白い面に描画し、選択したページごとに画像を作ります。ページ内の写真を元の解像度・圧縮のまま取り出す機能ではありません。

必要な解像度を選ぶ

72・144・216・288 dpiから選べます。小さなプレビューなら低め、細かい文字やOCR用なら多めのピクセルが必要な場合があります。多数のページを変換する前に一枚で試してください。

解像度を2倍にすると、ピクセル数はおよそ4倍になります。メモリ使用量と処理時間も増えます。一ページの上限は1600万ピクセルなので、大きい用紙では低いdpi設定が必要な場合があります。

ぼやけたスキャンを高解像度で出力しても、元になかった細部は増えません。より鮮明な原本を用意するほうが有効な場合があります。

ページと出力順を指定する

1-3, 5なら4ページを選択します。5, 1と入力すると、その順で出力します。空欄は全ページです。文書に存在するページ番号を指定してください。

一回に選択できるのは最大50ページです。長い文書は範囲を分け、その都度保存してから次に進みます。画像は個別に、またはZIPでまとめてダウンロードできます。ページを一枚の長い画像につなぐ機能はありません。

スキャン画像の文字を認識する

  1. PDFですでに文字を選択できるか確認します。
  2. 選択できない場合は、必要なページを鮮明なPNGとして保存します。
  3. 画像の文字起こしでPNGを選びます。
  4. 画像の本文に合う言語を選びます。日本語の文書なら日本語を選択してください。
  5. OCRを実行し、文字、氏名、数値、改行を原文と照合します。
  6. 修正した文字をコピーするか、TXTとして保存します。

OCRは文字を認識する機能で、内容が正しいかを判断するものではありません。表や段組みの順番が崩れることもあります。出力はプレーンテキストで、書式付きのWordや検索可能なPDF層ではありません。

PDFの画像がぼやけるとき・OCRが誤認識するとき

文書全体を処理する前に1ページで試してください。小さな文字が読みにくい場合は、72・144dpiと216・288dpiを比較します。ただし、ぼやけたスキャンに元々ない細部は、出力解像度を上げても復元できません。

文字が誤認識される場合は、ページの向きと認識言語を確認します。必要なページを書き出し、画像をトリミングして本文の領域に絞り、OCRを再実行してください。氏名、日付、数値は原本と照合します。信頼度の数値は正確性の保証ではありません。

原本と機密情報を確認する

端末内の処理では、このツールによるファイルのアップロードを避けられます。ただし、機密メタデータがないことや共有に適していることを保証しません。原本を残し、必要な内容だけを渡してください。

パスワード保護されたPDFは開けません。PDFの透かしは見える目印であり、暗号化ではありません。画像ページをまとめるには画像をPDFに変換、形式の選択には画像形式ガイドを使えます。

書き出した画像に容量制限がある場合は画像圧縮ガイドを参考にしてください。

よくある質問

PDFを直接TXTに変換できますか?
OCRの入力は画像です。スキャンなら先にPDFページをPNGへ変換してください。すでに文字を選択できるPDFなら、閲覧アプリからコピーするほうが簡単な場合があります。
PDFをPNGにすると完全な可逆変換になりますか?
PNGは描画後のピクセルを非可逆圧縮せず保存します。ただし描画時に文字やベクトルを有限のピクセルに変えるため、PDFの構造をそのまま保つ変換ではありません。
JPGにしたら文字を選べなくなったのはなぜですか?
JPGには文字オブジェクトではなくピクセルが入っています。文書機能が必要ならPDFを残してください。画像しかない場合はOCRを利用できます。
50ページを超える文書も処理できますか?
一回の選択を50ページ以内に分ければ処理できます。扱いやすい範囲で進め、各回の結果を保存してから続けてください。
スキャンしたPDFを編集できるWordにできますか?
必要なページをPNGにし、OCRで文字を抽出して、確認した文字をWordに貼り付けられます。保存形式はTXTで、DOCXではありません。表、段組み、レイアウトは別途整える必要があり、PDFに検索用の文字層を追加する機能もありません。

執筆者について

Abdul Basit

Abdul BasitはQuickImageFixを運営し、画像圧縮、サイズ変更、形式変換、PDF編集のガイドを執筆しています。各ツールでできることや、仕上がりに影響する設定を説明しています。

画像のプライバシーについて

画像の選択から保存まで、ファイルはご自身の管理下にあります。

ブラウザ内で処理
画像やPDFは端末内で処理します。背景透過や文字認識も端末内で行いますが、初回は処理用ファイルをダウンロードする場合があります。
サーバー上にファイルを保存しません
画像をサーバーに送信・保存しないため、サーバー側の削除待ち時間もありません。ツールをリセットするかタブを閉じると作業を終了できます。元画像と保存した結果は、ご自身で削除するまで端末に残ります。
選択したファイルだけを使用
ブラウザで選択したファイルを処理します。公開画像リンクを作ったり、元のファイルを上書きしたりしません。プレビューや保存用リンクは作業中の端末内で作成します。

ブラウザには処理用モデル、OCRの言語データ、ゲームの最高得点が保存される場合があります。処理したファイルは含まれません。削除するには、このサイトのブラウザデータを消去してください。ダウンロードしたファイルは別途管理してください。

プライバシーポリシーを読む

無料でブラウザ内で処理。ファイルのアップロードは不要です。