Transformer la photo d'une page en scan
La photo d'un document est grise, éclairée d'un seul côté et légèrement de travers. Cet outil la redresse, uniformise l'éclairage pour que le papier ressorte blanc, et l'enregistre en PDF — avec, en option, le texte en arrière-plan pour que le scan soit interrogeable.
- Jamais conservé
- Pas de file d'attente, pas d'attente
- Sans inscription, sans filigrane
Comment ça marche
Ajoutez vos photos
Une page ou plusieurs — elles deviennent les pages d'un seul PDF, dans l'ordre où vous les avez ajoutées.
Regardez-la se nettoyer
L'inclinaison est mesurée et corrigée, et le papier derrière l'encre est estimé puis éclairci jusqu'au blanc : c'est ce qui fait qu'une photo cesse de ressembler à une photo.
Téléchargez le PDF
Demandez une couche de texte : les mots sont lus et placés de façon invisible sur la page, pour que le scan puisse être interrogé et que l'on puisse en copier le texte.
Transformer une photo en quelque chose qui se lit comme un document
La photo d'une page et le scan d'une page diffèrent sur trois points, et deux d'entre eux sont corrigés ici. La page est redressée — une feuille passée de travers, ou photographiée légèrement tournée, est remise droite — et remise à l'endroit : une page capturée de côté ressort dans le bon sens. Ces deux corrections étaient de toute façon nécessaires à la lecture, c'est pourquoi elles sont offertes. Le contraste est relevé pour que le papier apparaisse blanc et l'encre noire, plutôt qu'une photo grise d'un document.
La troisième différence n'est pas corrigée, et c'est celle qu'il faut anticiper. La perspective n'est pas corrigée : une page photographiée en biais garde sa forme de trapèze, plus étroite du côté éloigné, et seule sa rotation est redressée. Une page fortement pliée, ou incurvée vers la reliure d'un livre épais, reste incurvée. Les deux défauts rendent le texte plus difficile à lire en plus d'être disgracieux — la chose la plus utile que vous puissiez faire est donc de tenir l'appareil bien au-dessus de la page plutôt que de vous pencher dessus.
Demander une couche de texte vous donne un PDF qui ressemble exactement à la photo et se comporte comme un document : les mots reconnus sont placés de façon invisible sur les mots de l'image, si bien que le fichier peut être interrogé, sélectionné et copié tout en restant une image de l'original. Rien n'est recomposé et l'apparence reste inchangée — ce que vous voulez pour un ticket de caisse, un contrat ou tout document dont l'aspect d'origine fait partie de la trace.
La précision dépend de la prise de vue, et les écarts sont nets. Une page à plat, uniformément éclairée, nette et bien face à l'appareil se lit bien ; l'ombre de votre propre tête sur la page, le flash d'un téléphone qui se reflète sur du papier brillant ou un ticket froissé, non. Les mots en chinois, japonais et coréen sont reconnus, mais comptés plutôt qu'écrits dans la couche de texte, car aucune police capable de les contenir n'est fournie — on vous indique combien il y en a, plutôt que de vous laisser des blancs que vous pourriez ne pas remarquer.
Si vous cherchez autre chose
Votre téléphone intègre très probablement cette fonction, en mieux. L'app Notes sur iOS et Google Drive sur Android scannent tous deux les documents avec une correction de perspective en direct — ils repèrent les bords de la page pendant que vous tenez l'appareil et aplatissent correctement le trapèze, soit précisément l'étape qui manque ici. Pour photographier une page, utilisez l'un d'eux et importez ensuite le résultat ailleurs si vous devez le retravailler.
Pour une pile de pages, OCRmyPDF est le bon outil, et il est gratuit : ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdf effectue le redressement, la rotation, le nettoyage et la couche de texte en une seule passe sur un document de n'importe quelle longueur, et --output-type pdfa le rend en même temps conforme à l'archivage. unpaper se charge des nettoyages de scan plus difficiles — supprimer la bordure noire d'un livre scanné, séparer les doubles pages — que rien ici ne tente.
Questions fréquentes
Que modifie-t-il concrètement ?
Trois choses. L'inclinaison : l'angle du texte est mesuré sur toute la page puis corrigé, pour que les lignes soient horizontales. L'éclairage : la luminosité du papier derrière l'encre est estimée par zones et ramenée à un blanc uniforme, ce qui supprime l'assombrissement vers un bord et l'ombre de votre main. Et le contraste : l'encre est assombrie par rapport à ce blanc. En revanche, rien n'est inventé — aucun détail n'est créé par accentuation.
Peut-il rendre le scan interrogeable ?
Oui. Activez la couche de texte : chaque mot est lu et placé de façon invisible sur l'image, à l'endroit où il apparaît, pour que Ctrl+F le trouve et que vous puissiez sélectionner et copier du texte dans le PDF. La page ressemble toujours exactement à la photo ; le texte n'est jamais dessiné, seulement rendu sélectionnable.
Ma photo est-elle conservée quelque part ?
Non. Le nettoyage et la lecture se font tous deux ici, et rien n'est conservé. Rien n'est envoyé nulle part.
Faut-il d'abord recadrer sur la page ?
Cela aide. L'estimation du papier fonctionne mieux quand le papier occupe la majeure partie du cadre : une photo avec un bureau sombre sur les bords donne un meilleur résultat si vous la recadrez d'abord. La mesure de l'inclinaison ignore volontairement les marges extérieures, donc un peu d'arrière-plan ne pose pas de problème.
Corrige-t-il une photo prise en biais ?
Il corrige la rotation — une page inclinée de quelques degrés est remise droite. Il ne corrige pas la perspective : une page photographiée de côté, avec un bord plus long que l'autre, garde cette forme. Photographier bien à la verticale vaut la seconde de plus.
Couleur ou noir et blanc ?
La couleur est conservée, avec le papier blanchi derrière — un tampon, une signature à l'encre bleue ou une ligne surlignée gardent donc leur couleur. C'est généralement ce que l'on attend d'un document ; ce n'est pas un fax en noir et blanc.
Quelle sera la taille du PDF ?
Chaque page est enregistrée en JPEG dimensionné pour la lecture plutôt qu'à la pleine résolution de l'appareil : une photo de téléphone de 4 MB descend généralement sous 1 MB par page, sans perte visible à 100 %.
Bon à savoir : La perspective n'est pas corrigée : une page photographiée en biais garde sa forme de trapèze, seule la rotation est corrigée. Une page fortement pliée ou très incurvée près de la reliure restera incurvée. La couche de texte, si vous en demandez une, comporte les mêmes réserves que toute OCR — et les mots en chinois, japonais et coréen sont comptés plutôt qu'écrits, car aucune police capable de les afficher n'est fournie.
Intégrez cet outil à votre site
Gratuit pour tout blog, page de cours ou article d'aide. Collez un seul extrait de code et vos visiteurs pourront l'utiliser directement sur votre page.
Outils associés
Image en texte
Le texte d'une image, dans plus de 120 langues
OCR PDF
Rendez un scan interrogeable
JPG en PDF
Vos photos dans un seul PDF, dans votre ordre
OCR de capture d'écran
Collez une capture d'écran, récupérez le texte
Reconnaissance d'écriture manuscrite
L'écriture en capitales, lue honnêtement
Lecteur de QR code
Voyez ce que dit un QR code avant de le suivre