사진 속 글자를 텍스트로
사진, 스캔본, 스크린샷에서 글자를 읽어 내 편집·검색·붙여넣기가 가능한 텍스트로 가져가세요. 사진은 저장하지 않습니다.
- 저장되지 않음
- 대기열 없음, 기다림 없음
- 회원가입 없음, 워터마크 없음
사용 방법
사진 추가
JPG, PNG, WebP, GIF, BMP, iPhone HEIC, 스캐너의 TIFF를 지원합니다. 비스듬히 찍은 사진은 읽기 전에 기울기를 바로잡고 조명을 고르게 맞춥니다.
언어 확인
사진에서 문자 체계를 읽어 언어를 자동으로 골라 드립니다. 잘못 추측했거나 사진에 여러 언어가 섞여 있다면 120개 이상 언어 중에서 고를 수 있습니다.
복사 또는 다운로드
줄과 열을 원래 위치 그대로 두는 레이아웃 유지를 고르거나, 다른 곳에 붙여 넣기 좋게 줄을 이어 문단으로 만드세요.
사진을 읽는 방식
인식기가 원하는 크기는 파일이 아니라 글자에서 측정합니다. 텍스트 한 줄의 높이를 사진 자체에서 추정한 뒤, 한 줄이 약 34픽셀이 되도록 전체 크기를 조정합니다. 작은 스크린샷은 최대 4배까지 키우고, 아주 큰 사진은 줄이며, 어느 쪽이든 긴 변에는 상한이 있습니다. 그래서 900만 화소로 찍은 메뉴판 사진이 선명한 작은 사진보다 더 정확하지 않고, 짧은 변이 약 300픽셀 미만인 사진은 언어 감지를 아예 건너뛰고 라틴 문자로 읽습니다. 그에 앞서 글자 뒤의 종이 색을 구역별로 추정해 나눠 조명을 고르게 하고, 페이지 전체 높이에 걸쳐 기울기를 측정해 똑바로 돌린 다음, 전체에 하나의 임계값을 적용해 흑백으로 바꿉니다.
언어 선택은 조회가 아니라 오디션입니다. 흔히 쓰는 감지기는 사실 언어를 감지하지 않기 때문입니다. 첫 단계는 문자 체계와 회전만 알려 줄 뿐입니다. 문자 체계로 후보를 좁히고, 같은 문자를 쓰는 언어끼리는 브라우저의 언어 설정으로 우열을 가린 뒤, 각 후보로 축소한 사진을 실제로 읽어 확신 있는 단어를 얼마나 많이 냈는지 점수를 매깁니다. 이긴 언어가 실제 페이지를 읽고, 인식된 텍스트를 다시 발음 부호, 특징적인 글자 쌍, 흔한 짧은 단어 기준으로 살펴 다른 언어가 더 나을지 확인합니다. “언어를 잘못 지정하면 확신에 찬 빈 페이지가 나온다”는 말 뒤에 있는 장치가 바로 이것입니다. 오디션은 추측을 단정하지 않고 실제 사진으로 검증하기 위해 존재합니다.
결과에 무엇이 나오는지에 대해 알아 둘 점이 하나 있습니다. 인식기가 확신하지 못한 문단은 표시하지 않고 버립니다. 그래서 사진에서 보이는 글자가 엉뚱한 문자로 나오는 대신 결과에서 통째로 빠질 수 있습니다. 인식기가 그림이나 잡음으로 분류한 블록, 글자나 숫자가 없는 외딴 표시도 마찬가지입니다. 확신도가 낮은 일반 단어에는 이런 기준을 적용하지 않으므로, 문단 안의 오인식은 그대로 남아 직접 찾아내야 합니다. 확신도 수치는 괜찮은데 페이지의 한 부분이 그냥 없다면, 바로 이런 일이 일어난 것입니다.
다른 작업이 필요할 때
아무것도 저장하지 않지만, 이 도구는 사이트에서 처음 실행이 공짜가 아닌 유일한 도구입니다. 인식기 자체가 몇 MB이고 언어 팩마다 1~5 MB가 더 필요하며, 이 사이트에서 받아 온 뒤 다음을 위해 보관됩니다. 한 페이지라면 기다릴 만하지만 정기적으로 스캔 2,000장을 처리한다면 그렇지 않습니다. 그럴 때는 OCRmyPDF 같은 데스크톱 OCR 도구가 맞습니다. 명령 하나로 폴더 전체에 텍스트 레이어를 넣어 주며, 다운로드도 클릭도 필요 없습니다.
여기서 아예 시도하지 않는 것이 세 가지 있으며, 직접 겪기 전에 알아 두는 편이 빠릅니다. 원근은 보정하지 않습니다. 페이지의 회전을 측정해 똑바로 돌리지만, 옆에서 찍은 사진은 사다리꼴 모양이 그대로 남으므로 바로 위에서 찍는 데 1초를 더 쓸 가치가 있습니다. 글자와 종이를 가르는 임계값은 영역마다가 아니라 사진 전체에 하나이므로, 절반이 그늘진 페이지는 조명을 고르게 맞춘 뒤에도 어두운 절반을 놓칩니다. 씨름하지 말고 고른 조명에서 다시 찍으세요. 그리고 괘선 없이 간격으로만 배치한 표는 찾을 괘선이 없어 여러 단의 글로 읽히므로, 스프레드시트에 붙여 넣었을 때 제대로 되는 건 운입니다.
자주 묻는 질문
얼마나 정확한가요?
정면에서 초점을 맞춰 찍은 선명한 인쇄 글자라면 매우 정확합니다. 1,000자 중 몇 자 정도만 틀립니다. 흐림, 반사광, 낮은 대비, 특이한 서체가 있으면 정확도가 떨어지며, 페이지는 추측하게 두지 않고 인식이 얼마나 확실했는지 보여 줍니다. 수치가 낮다면 대개 사진이 문제입니다. 조명을 밝게 하고, 각도를 줄이고, 글자가 화면을 채우도록 찍으면 대부분 해결됩니다.
제 사진이 어딘가에 저장되나요?
아니요. 언어 팩은 해당 언어를 처음 사용할 때 이 사이트에서 받아 옵니다. 사진 자체는 저장되지도, 어디로 전송되지도 않으므로 Wi-Fi를 꺼도 작동합니다.
어떤 언어를 읽을 수 있나요?
영어, 벵골어, 힌디어, 우르두어, 아랍어, 스페인어, 프랑스어, 독일어, 포르투갈어, 러시아어, 중국어, 일본어, 한국어를 포함해 120개 이상입니다. 문자 체계는 사진 자체에서 읽어 내고, 라틴·키릴·아랍·데바나가리 문자처럼 여러 언어가 같은 문자를 쓰는 경우에는 브라우저의 언어 설정으로 결정하며, 언제든 바꿀 수 있습니다.
열과 표가 유지되나요?
네, 원하시면 유지됩니다. 괘선이 있는 표는 찾아내 셀 단위로 읽으므로 항목명과 값이 뒤섞이지 않으며, 탭으로 구분된 행으로 나와 스프레드시트에 바로 붙여 넣을 수 있습니다. 여러 단으로 된 글은 가로로 곧장 읽지 않고 읽는 순서대로 읽습니다. 대신 줄 잇기를 고르면 그 구조를 일부러 버리는데, 곧 다시 흘려 넣을 문단이라면 그게 원하는 결과입니다.
손글씨도 읽을 수 있나요?
양식에 쓴 대문자처럼 또박또박 떨어뜨려 쓴 글씨는 꽤 잘 나옵니다. 이어 쓴 필기체는 여기서도, 다른 일반 OCR 도구에서도 읽히지 않습니다. 솔직히 말해 이는 다른 접근이 필요한 다른 문제입니다. 손글씨 전용 페이지가 따로 있으며, 그 점을 분명히 밝히고 인식한 결과를 보여 줍니다.
어떤 이미지 형식을 지원하나요?
브라우저 자체로 JPG, PNG, WebP, GIF, BMP, SVG를 지원하고, iPhone의 HEIC와 스캐너의 TIFF도 지원합니다. 휴대폰으로 세로로 찍은 사진도 카메라가 기록한 방향 정보를 먼저 적용하므로 똑바로 나옵니다.
왜 일부 단어를 틀렸나요?
거의 항상 글자보다는 사진 때문입니다. 페이지를 가로지르는 반사광, 손 그림자, 손떨림, 또는 화면 속 글자가 너무 작아 글자 하나가 몇 픽셀밖에 안 되는 경우입니다. 인식기에는 가장 잘 읽는 크기로 조정한 사진이 전달되고 조명도 먼저 고르게 맞추지만, 어떤 보정도 카메라가 담지 못한 세부를 만들어 내지는 못합니다.
용량 제한이 있나요?
기기 자체의 메모리뿐입니다. 아무것도 저장하지 않으므로 서버 제한에 걸릴 일도 없습니다. 아주 큰 사진은 인식기가 활용할 수 있는 크기로 줄입니다. 일정 수준을 넘으면 픽셀이 많아져도 비용만 늘고 정확도는 오르지 않습니다.
참고: 이어 쓴 필기체는 이 도구를 포함해 어떤 일반 OCR 도구로도 안정적으로 인식되지 않습니다. 그림 위에 인쇄된 글자, 장식이 심한 글자체, 대비가 매우 낮은 글자는 군데군데 빠질 수 있습니다. 결과는 일반 텍스트이며 서체, 색, 굵게, 기울임꼴은 옮겨지지 않고 사진 자체도 포함되지 않습니다.
내 웹사이트에 이 도구 넣기
블로그, 수업 페이지, 도움말 글 어디에나 무료로 넣을 수 있습니다. 코드 한 줄만 붙여 넣으면 방문자가 페이지에서 바로 사용할 수 있습니다.