コンテンツへスキップ

撮影したページをスキャンに変える

書類を撮った写真は、グレーっぽく、片側から光が当たり、少し傾いています。このツールは傾きを直し、紙が白くなるよう明るさを均一にして、PDFで保存します。テキストを裏に埋め込んで、スキャンを検索可能にすることもできます。

  • 保存しません
  • 順番待ちなし
  • 登録不要・透かしなし

使い方

1

写真を追加

1ページでも複数ページでもOK。追加した順番で、1つのPDFのページになります。

2

きれいになるのを確認

傾きを測って取り除き、インクの背景にある紙の明るさを推定して白くします。これで写真が写真らしく見えなくなります。

3

PDFをダウンロード

テキストレイヤーを指定すると、文字を読み取ってページの上に見えない形で重ねるので、スキャンを検索したり、コピーしたりできます。

写真を「書類として読める」ものにする

ページの写真とページのスキャンには3つの違いがあり、ここではそのうち2つを直します。ページはまっすぐになります。斜めに通したり少し回転して撮ったりした紙は水平に戻ります。そして正しい向きになるので、横向きに撮ったページも正しい向きで出力されます。どちらも読み取りのためにもともと必要な処理なので、おまけで付いてきます。コントラストを上げるので、書類を撮ったグレーっぽい写真ではなく、紙は白、インクは黒として見えるようになります。

3つ目の違いは直せません。これを前提に準備しておくことが大切です。遠近の歪みは補正しません。斜めから撮ったページは奥側が狭い台形のままで、直るのは回転だけです。深い折り目のあるページや、厚い本ののど元に向かって湾曲したページも、曲がったままです。どちらも見た目が悪くなるだけでなく、文字も読み取りにくくなります。ですから一番効果的なのは、ページの上にかがみ込むのではなく、カメラをページの真上に構えることです。

テキストレイヤーを指定すると、見た目は写真とまったく同じで、書類として扱えるPDFになります。認識した単語が画像内の単語の上に見えない形で配置されるので、原本の画像のまま、検索・選択・コピーができます。組み直しは一切なく、見た目も変わりません。レシートや契約書など、原本の見た目も記録の一部であるものには、まさにこれが望ましい形です。

精度は撮影の仕方で決まり、その差ははっきり出ます。平らで、均一な明るさで、ピントが合い、カメラに対して正面を向いていればよく読み取れます。自分の頭の影がページにかかっていたり、光沢紙にスマホのフラッシュが反射していたり、レシートがくしゃくしゃだったりすると、うまくいきません。中国語・日本語・韓国語の単語は認識されますが、テキストレイヤーには書き込まれず、数だけが表示されます。これらを扱えるフォントを同梱していないためです。気づかないかもしれない空白を残すのではなく、何語あったかをお知らせします。

ほかの目的には

お使いのスマホには、ほぼ確実にもっと優れた機能が内蔵されています。iOSのメモアプリとAndroidのGoogleドライブは、どちらもリアルタイムの遠近補正付きで書類をスキャンできます。カメラを構えている間にページの端を検出し、台形をきちんと平らにしてくれます。まさにここにない処理です。ページを撮影するならそちらを使い、さらに作業が必要なら結果をほかのツールに持っていきましょう。

何ページもある書類なら、無料のOCRmyPDFが最適です。ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdfで、傾き補正、回転、クリーンアップ、テキストレイヤーの追加を、どんな長さの文書にも1回で行えます。--output-type pdfaを付ければ、同時に長期保存用にもなります。本のスキャンの黒い縁取りの除去や見開き2ページの分割など、ここでは扱わない高度なスキャンのクリーンアップにはunpaperが対応しています。

よくある質問

実際に何が変わるのですか?

3つです。傾き:ページ全体で文字の角度を測って取り除き、行を水平にします。明るさ:インクの背景にある紙の明るさを区画ごとに推定して均一な白にし、片側に向かって暗くなる部分や手の影を取り除きます。コントラスト:その白に対してインクを濃くします。何かを作り出すことはしません。シャープ化で存在しないものを生み出すこともありません。

スキャンを検索可能にできますか?

はい。テキストレイヤーをオンにすると、すべての単語を読み取り、画像上の該当する位置に見えない形で配置します。Ctrl+Fで検索でき、PDFから選択してコピーすることもできます。ページの見た目は写真とまったく同じままです。テキストは描画されず、選択できるようになるだけです。

写真はどこかに保存されますか?

いいえ。補正も読み取りもこの場で行われ、何も保存されません。どこにも送信されません。

先にページ部分をトリミングしたほうがよいですか?

そのほうが効果的です。紙の明るさの推定は、画面の大部分が紙のときに最もうまくいきます。周りに暗い机が写っている写真は、先にトリミングしたほうがきれいに仕上がります。傾きの測定は外側の余白をあえて無視するので、背景が少し写っている程度なら問題ありません。

斜めから撮った写真も直せますか?

回転は取り除きます。数度傾いたページは水平に直ります。ただし遠近の歪みは補正しないので、横から撮って片側の辺がもう片側より長くなったページは、その形のままです。真上から撮る一手間をかける価値があります。

カラーですか、白黒ですか?

カラーのまま、背景の紙だけを白くします。そのため、印鑑、青インクの署名、マーカーを引いた行は元の色のままです。書類にはたいていこれが望ましい形で、白黒のファックスとは違います。

PDFのサイズはどのくらいになりますか?

各ページはカメラのフル解像度ではなく、読むのに適したサイズのJPEGとして保存されます。そのため、4 MBあったスマホの写真は、100%表示で見た目の劣化なく、たいてい1ページ1 MB未満に収まります。

ご注意: 遠近の歪みは補正しません。斜めから撮ったページは台形のままで、直るのは回転だけです。深い折り目や、のど元の強い湾曲があるページは曲がったままです。テキストレイヤーを指定した場合、ほかのOCRと同じ注意点があります。また、中国語・日本語・韓国語の単語は、対応するフォントを同梱していないため、書き込まれず数だけが表示されます。

このツールをあなたのサイトに設置

ブログ、授業のページ、ヘルプ記事などに無料で設置できます。コードを1つ貼り付けるだけで、訪問者がそのページ上でツールを使えるようになります。