본문 바로가기

문서 사진을 스캔본으로

문서를 찍은 사진은 칙칙하고, 한쪽에서만 빛을 받고, 살짝 기울어 있습니다. 이 도구는 기울기를 바로잡고 조명을 고르게 해 종이를 하얗게 만든 뒤 PDF로 저장합니다. 원하면 뒤에 텍스트를 넣어 스캔본을 검색할 수 있게 만듭니다.

  • 저장되지 않음
  • 대기열 없음, 기다림 없음
  • 회원가입 없음, 워터마크 없음

사용 방법

1

사진 추가

한 장이든 여러 장이든, 추가한 순서대로 PDF 하나의 페이지가 됩니다.

2

보정 확인

기울기를 측정해 없애고, 글자 뒤의 종이 색을 추정해 하얗게 끌어올립니다. 이 과정이 사진을 사진처럼 보이지 않게 만듭니다.

3

PDF 다운로드

텍스트 레이어를 선택하면 글자를 읽어 페이지 위에 보이지 않게 겹쳐 두므로, 스캔본에서 검색하고 복사할 수 있습니다.

사진을 문서처럼 읽히게 만드는 과정

페이지를 찍은 사진과 스캔한 페이지는 세 가지가 다르며, 그중 두 가지를 여기서 바로잡습니다. 페이지를 똑바로 펴서, 비스듬히 들어갔거나 살짝 돌아간 채 찍힌 종이를 수평으로 맞추고, 바로 세워서 옆으로 누운 채 찍힌 페이지도 똑바로 나오게 합니다. 둘 다 어차피 인식에 필요했던 과정이라 덤으로 따라옵니다. 대비를 높여 문서를 찍은 칙칙한 사진이 아니라 흰 종이와 검은 글자로 보이게 합니다.

세 번째 차이는 바로잡지 않으며, 미리 대비해야 할 부분입니다. 원근은 보정하지 않습니다. 비스듬히 찍은 페이지는 먼 쪽이 좁은 사다리꼴 모양이 그대로 남고, 회전만 바로잡힙니다. 심하게 접힌 페이지나 두꺼운 책의 제본 쪽으로 휜 페이지는 여전히 휘어 있습니다. 둘 다 보기에도 나쁘고 글자 인식도 어렵게 만듭니다. 그래서 할 수 있는 가장 유용한 일은 페이지 위로 몸을 기울이지 말고 카메라를 페이지 바로 위에 두는 것입니다.

텍스트 레이어를 선택하면 사진과 똑같이 보이면서 문서처럼 동작하는 PDF가 나옵니다. 인식된 단어를 사진 속 단어 위에 보이지 않게 배치하므로, 원본의 이미지이면서도 검색, 선택, 복사가 가능합니다. 다시 조판하지 않으므로 겉모습은 그대로입니다. 영수증, 계약서처럼 원본의 모양 자체가 기록의 일부인 문서에 딱 맞습니다.

정확도는 촬영 상태를 따르며, 차이는 미묘하지 않습니다. 평평하고, 조명이 고르고, 초점이 맞고, 카메라와 정면으로 마주한 페이지는 잘 읽힙니다. 페이지에 드리운 내 머리 그림자, 광택지에 반사된 휴대폰 플래시, 구겨진 영수증은 그렇지 않습니다. 중국어·일본어·한국어 단어는 인식되지만 텍스트 레이어에 기록되지 않고 개수만 집계됩니다. 이를 담을 수 있는 글꼴이 포함되어 있지 않기 때문입니다. 알아채지 못할 수도 있는 빈칸으로 남기는 대신 몇 개인지 알려 드립니다.

다른 작업이 필요할 때

휴대폰에 이 기능이 이미 더 좋은 형태로 들어 있을 가능성이 큽니다. iOS의 메모 앱과 Android의 Google Drive는 모두 실시간 원근 보정으로 문서를 스캔합니다. 카메라를 대는 동안 페이지 가장자리를 찾아 사다리꼴을 제대로 펴 주는데, 바로 여기에 빠진 단계입니다. 페이지를 찍을 때는 그 앱을 쓰고, 작업이 필요하면 결과물을 다른 곳으로 가져가세요.

여러 페이지를 처리한다면 OCRmyPDF가 알맞은 무료 도구입니다. ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdf 한 번이면 길이에 상관없이 문서 전체의 기울기 보정, 회전, 정리, 텍스트 레이어를 처리하고, --output-type pdfa를 붙이면 동시에 보존용 형식으로 만듭니다. unpaper는 책 스캔본의 검은 테두리 제거, 두 쪽 펼침면 분리처럼 여기서는 시도하지 않는 더 어려운 스캔 정리를 맡습니다.

자주 묻는 질문

실제로 무엇이 바뀌나요?

세 가지입니다. 기울기: 페이지 전체에서 글자의 각도를 측정해 없애므로 줄이 수평이 됩니다. 조명: 글자 뒤 종이의 밝기를 구역별로 추정해 균일한 흰색으로 끌어올려, 한쪽 가장자리로 갈수록 어두워지는 부분과 손 그림자를 없앱니다. 대비: 그 흰색에 맞춰 글자를 더 진하게 합니다. 하지 않는 일은 무언가를 만들어 내는 것입니다. 없던 선명함을 지어내지 않습니다.

스캔본을 검색 가능하게 만들 수 있나요?

네. 텍스트 레이어를 켜면 모든 단어를 읽어 사진 속 해당 위치 위에 보이지 않게 배치하므로, Ctrl+F로 찾을 수 있고 PDF에서 선택해 복사할 수 있습니다. 페이지는 여전히 사진과 똑같이 보입니다. 텍스트는 그려지지 않고 선택할 수 있게만 됩니다.

제 사진이 어딘가에 저장되나요?

아니요. 보정과 인식 모두 여기서 이루어지며, 아무것도 저장하지 않습니다. 어디로도 전송되지 않습니다.

먼저 페이지에 맞게 잘라야 하나요?

도움이 됩니다. 종이 색 추정은 화면 대부분이 종이일 때 가장 잘 되므로, 가장자리에 어두운 책상이 보이는 사진은 먼저 잘라 내면 더 잘 나옵니다. 기울기 측정은 바깥 여백을 일부러 무시하므로 배경이 조금 있는 건 문제없습니다.

비스듬히 찍은 사진도 바로잡아 주나요?

회전은 없앱니다. 몇 도 기울어진 페이지는 수평으로 맞춥니다. 원근은 보정하지 않으므로, 옆에서 찍어 한쪽 변이 더 긴 페이지는 그 모양 그대로 남습니다. 바로 위에서 찍는 데 1초를 더 쓸 가치가 있습니다.

컬러인가요, 흑백인가요?

컬러를 유지하고 그 뒤의 종이만 하얗게 만듭니다. 그래서 도장, 파란 잉크 서명, 형광펜 줄은 원래 색 그대로 남습니다. 문서에서 보통 원하는 결과가 그것이며, 흑백 팩스가 아닙니다.

PDF 용량은 얼마나 되나요?

각 페이지는 카메라의 원래 해상도가 아니라 읽기에 알맞은 크기의 JPEG으로 저장됩니다. 그래서 4 MB였던 휴대폰 사진이 보통 페이지당 1 MB 미만이 되며, 100%로 봐도 눈에 띄는 손실이 없습니다.

참고: 원근은 보정하지 않습니다. 비스듬히 찍은 페이지는 사다리꼴 모양이 그대로 남고 회전만 바로잡습니다. 심하게 접힌 페이지나 책 제본 쪽으로 강하게 휜 페이지는 여전히 휘어 있습니다. 텍스트 레이어를 요청한 경우 일반 OCR과 같은 한계가 있으며, 중국어·일본어·한국어 단어는 이를 쓸 수 있는 글꼴이 포함되어 있지 않아 기록되지 않고 개수만 집계됩니다.

내 웹사이트에 이 도구 넣기

블로그, 수업 페이지, 도움말 글 어디에나 무료로 넣을 수 있습니다. 코드 한 줄만 붙여 넣으면 방문자가 페이지에서 바로 사용할 수 있습니다.