スキャンしたPDFを使うべき場面(そして避けるべき場面)
最終更新日
スキャンしたPDFが解決するのは、1つの明確な課題です。紙を、共有・保存でき、どの端末でも閲覧できるデジタルファイルに変えることです。その点では優れています。しかし、同じ内容をパソコンで作成したPDFに比べると、ファイルサイズは大きく、OCR(文字認識)なしでは検索できず、編集もしにくく、元の紙より解像度が低くなることも多いです。すでにデジタルで存在している文書をスキャンするのは、ほぼ常に間違った選択です。
正しいルールは単純です。デジタルの元データがない紙だけをスキャンしましょう。Word文書、スクリーンショット、PDFの書き出しとしてすでに持っているものは、スキャンしないでください。文書を「固定する」ために印刷してからスキャンし直したくなる気持ちはわかりますが、たいていは不要です — 直接PDFとして書き出すほうが、同じことをより良い形でこなせます。
このガイドでは、スキャンすべきときとすべきでないときを解説します。ほとんどは、いったん言葉にしてしまえば直感的にわかることですが、問題は、スキャンしたいという衝動が、実際の必要性より強く働いてしまうことにあります。
手順
- 1
元データが紙しかない場合は、スキャンしたPDFを使う
古い契約書、手書きのノート、紙の領収書、郵送されてきた書類、手書きで署名された書式。物理的に存在していて、デジタル化する必要があるものです。スマホのスキャンしてPDFにや据え置き型スキャナーを使えば、きれいなPDFができます。
- 2
デジタルで持っている文書はスキャンしない
Word文書、元のPDF、あるいは書き出したファイルを持っているなら、それを使いましょう。印刷してからスキャンし直すと、忠実度が失われ、ファイルは大きくなり、検索性も失われます。何のメリットもありません。
- 3
文書を「固定する」ためにスキャンしない
元データからPDFとして書き出し直せば、内容は固定されます。スキャンしても安全性は高まりません — 検索性とテキストの品質が失われるだけで、ファイルの改変しにくさが増すわけでもありません。
- 4
スキャンして検索性が必要な場合は、OCRを使う
OCR(文字認識)は、スキャンしたテキストの画像を、検索可能な下地のテキストに変換します。OCRがなければ、スキャンしたPDFは単なる文字の画像です — 読むことはできても、検索はできません。
- 5
共有前にスキャンを圧縮する
スキャンしたPDFは、日常的に扱うPDFの中でも特に大きくなりがちです。ブラウザ内のPDF圧縮を使えば、目立った画質の劣化なしに大幅に小さくできます。特にテキストだけの文書ではその効果が顕著です。
- 6
適切な解像度でスキャンする
画面で読む文書であれば200〜300 DPI、印刷する可能性がある文書であれば300 DPIが目安です。600 DPIは写真並みの画質で、テキストにとっては容量の無駄になります。
コツ
- 「これをスキャンしなければ」と思う瞬間の多くは、実は「デジタルで持っていたのを忘れていた」ことに気づく瞬間です。まずは元データを探しましょう。
- 直接PDFとして書き出すほうが、印刷してからスキャンするより、どの点で比べてもきれいです — より鮮明で、より軽く、検索でき、編集もできます。
- 端の自動検出とコントラスト調整のおかげで、今ではスマホでのスキャンも、一般的な文書であれば据え置き型スキャナーと同等の画質になっています。
- OCRをかけたスキャンは検索可能になりますが、テキストが完璧というわけではありません。OCRの結果はあくまでおおよそのものとして扱い、絶対的に正しいものとは考えないようにしましょう。
- 新しく作ったファイルを「公式っぽく見せる」ためにスキャンしないでください。形式自体は同じであり、それがスキャンされたのか書き出されたのかを気にする人はいません。