Перейти к содержимому

Превратить фото страницы в скан

Фотография документа серая, освещена с одной стороны и на градус перекошена. Здесь она выпрямляется, освещение выравнивается так, чтобы бумага стала белой, и всё сохраняется в PDF — по желанию с текстовым слоем, чтобы по скану можно было искать.

  • Не сохраняется
  • Без очереди и ожидания
  • Без регистрации и водяных знаков

Как это работает

1

Добавьте фото

Одну страницу или много — они станут страницами одного PDF в том порядке, в каком вы их добавили.

2

Посмотрите на очистку

Наклон измеряется и убирается, а фон бумаги под текстом оценивается и доводится до белого — именно поэтому фотография перестаёт выглядеть как фотография.

3

Скачайте PDF

Если включить текстовый слой, слова распознаются и невидимо накладываются на страницу, так что по скану можно искать и копировать из него текст.

Как фотография превращается в то, что читается как документ

Фотография страницы и скан страницы различаются тремя вещами, и две из них здесь исправляются. Страница выпрямляется — лист, прошедший через сканер под углом или сфотографированный слегка повёрнутым, выравнивается — и ставится вертикально, так что снятая боком страница получается правильно повёрнутой. Оба шага всё равно нужны для распознавания, поэтому достаются бесплатно. Контраст повышается, чтобы бумага выглядела белой, а текст чёрным, а не как серая фотография документа.

Третье различие не исправляется, и именно его нужно учитывать заранее. Перспектива не корректируется: страница, снятая под углом, сохраняет форму трапеции, сужаясь к дальнему краю, и выпрямляется только её поворот. Страница с сильным сгибом или изгибающаяся к корешку толстой книги останется изогнутой. И то и другое делает текст не только некрасивее, но и труднее для распознавания, — так что самое полезное, что вы можете сделать, — держать камеру прямо над страницей, а не наклоняться над ней.

Текстовый слой даёт PDF, который выглядит точно как фотография, а ведёт себя как документ: распознанные слова невидимо размещаются поверх слов на изображении, так что в файле можно искать, выделять и копировать текст, и при этом он остаётся изображением оригинала. Ничего не перенабирается, внешний вид не меняется — именно это нужно для чека, договора или всего, где внешний вид оригинала — часть документа.

Точность зависит от съёмки, и разница совсем не тонкая. Ровная, равномерно освещённая, в фокусе и параллельная камере страница распознаётся хорошо; тень от вашей головы на странице, вспышка телефона, отражающаяся от глянцевой бумаги, или мятый чек — нет. Слова на китайском, японском и корейском распознаются, но подсчитываются, а не записываются в текстовый слой, потому что шрифт, способный их отобразить, не встроен, — вам сообщают, сколько их, а не оставляют пропуски, которые вы можете не заметить.

Если нужно другое

В вашем телефоне почти наверняка есть встроенная функция, и она лучше. Приложение «Заметки» на iOS и Google Диск на Android сканируют документы с коррекцией перспективы в реальном времени — они находят края страницы, пока вы держите камеру, и правильно выпрямляют трапецию, а именно этого шага здесь нет. Чтобы сфотографировать страницу, используйте одно из них, а результат несите куда-то ещё, если с ним нужно работать.

Для стопки страниц правильный инструмент — бесплатный OCRmyPDF: ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdf за один проход выполняет выпрямление, поворот, очистку и добавление текстового слоя для документа любой длины, а --output-type pdfa заодно делает его архивным. unpaper справляется с более сложной очисткой сканов — убирает тёмную рамку со скана книги, разделяет развороты на две страницы, — чего здесь не делается вовсе.

Частые вопросы

Что именно меняется?

Три вещи. Наклон: угол текста измеряется по всей странице и убирается, так что строки становятся ровными. Освещение: яркость бумаги под текстом оценивается по участкам и доводится до равномерного белого — это убирает затемнение к одному краю и тень от руки. И контраст: текст затемняется на этом белом фоне. Чего он не делает, так это не придумывает ничего нового — резкость не создаётся из ничего.

Можно ли сделать скан доступным для поиска?

Да. Включите текстовый слой, и каждое слово будет распознано и невидимо размещено поверх изображения там, где оно находится, так что Ctrl+F его найдёт, а текст из PDF можно будет выделить и скопировать. Страница по-прежнему выглядит точно как фотография: текст не рисуется, а только становится выделяемым.

Моё фото где-нибудь сохраняется?

Нет. И очистка, и распознавание происходят здесь, и ничего не сохраняется. Ничего никуда не отправляется.

Нужно ли сначала обрезать фото по краю страницы?

Это помогает. Оценка фона бумаги работает лучше всего, когда большую часть кадра занимает бумага, поэтому фото с тёмным столом по краям получится лучше, если сначала его обрезать. Измерение наклона намеренно игнорирует внешние поля, так что немного фона — не проблема.

Исправит ли он фото, снятое под углом?

Он убирает поворот — страница, перекошенная на несколько градусов, выравнивается. Перспектива не исправляется, поэтому страница, снятая сбоку, у которой один край длиннее другого, сохранит эту форму. Снимать строго сверху стоит лишней секунды.

Цветной или чёрно-белый?

Цвет сохраняется, а бумага за ним отбеливается — так что печать, подпись синими чернилами или выделенная маркером строка остаются своего цвета. Обычно именно это и нужно от документа; это не чёрно-белый факс.

Какого размера будет PDF?

Каждая страница хранится как JPEG, размер которого подобран для чтения, а не как полное разрешение камеры, поэтому фото с телефона весом 4 MB обычно занимает меньше 1 MB на страницу без видимых потерь при масштабе 100%.

Полезно знать: Перспектива не исправляется: страница, снятая под углом, сохраняет форму трапеции, выравнивается только поворот. Страница с сильным сгибом или изгибом у корешка останется изогнутой. На текстовый слой, если вы его включите, распространяются те же оговорки, что и на любое OCR, — а слова на китайском, японском и корейском подсчитываются, но не записываются, потому что шрифт для них не встроен.

Разместите этот инструмент на своём сайте

Бесплатно для любого блога, страницы класса или справочной статьи. Вставьте один фрагмент кода — и посетители смогут пользоваться инструментом прямо на вашей странице.