Récupérer le texte d'une image
Lisez les mots d'une photo, d'un scan ou d'une capture d'écran et récupérez-les sous forme de texte à modifier, rechercher et coller. L'image n'est jamais conservée.
- Jamais conservé
- Pas de file d'attente, pas d'attente
- Sans inscription, sans filigrane
Comment ça marche
Ajoutez votre image
JPG, PNG, WebP, GIF, BMP, un HEIC d'iPhone ou le TIFF d'un scanner. Une photo prise de biais est redressée et son éclairage uniformisé avant la lecture.
Vérifiez la langue
L'écriture est identifiée à partir de l'image et la langue choisie pour vous. Plus de 120 langues sont disponibles si la détection s'est trompée, ou si l'image en contient plusieurs.
Copiez ou téléchargez
Conservez la mise en page, avec les lignes et les colonnes à leur place, ou fusionnez les lignes en paragraphes continus, prêts à être collés ailleurs.
Comment l'image est lue
La taille qui convient à la lecture se mesure à partir de l'encre, pas du fichier. La hauteur d'une ligne de texte est estimée à partir de l'image elle-même, et tout est remis à l'échelle pour qu'une ligne mesure environ trente-quatre pixels — une petite capture d'écran est agrandie jusqu'à quatre fois, et une photo énorme est réduite, le plus grand côté étant plafonné dans les deux cas. C'est pourquoi une photo de menu de neuf mégapixels n'est pas plus précise qu'une petite photo nette, et pourquoi une image de moins de trois cents pixels environ sur son plus petit côté saute entièrement la détection de langue et est lue comme de l'écriture latine. Avant tout cela, le papier derrière l'encre est estimé par zones puis retiré par division pour uniformiser l'éclairage, l'inclinaison de la page est mesurée sur toute sa hauteur puis corrigée, et le résultat est converti en noir et blanc selon un seuil global unique.
Le choix de la langue est une audition plutôt qu'une simple consultation, car le détecteur habituel ne détecte pas les langues. La première passe indique l'écriture et la rotation, rien de plus ; l'écriture réduit le champ, les paramètres de langue de votre navigateur départagent les langues qui la partagent, puis chaque candidate sert réellement à lire une copie réduite de l'image et reçoit un score selon le nombre de mots lus avec confiance. La gagnante lit la vraie page, et le texte reconnu est de nouveau examiné — signes diacritiques, paires de lettres caractéristiques, petits mots courants — pour voir si une autre langue ferait mieux. C'est le mécanisme derrière « indiquer la mauvaise langue donne une page vide en toute confiance » : l'audition existe justement pour que l'hypothèse soit testée sur votre image plutôt qu'affirmée.
Un point mérite d'être connu sur ce qui arrive dans le résultat. Un paragraphe sur lequel la lecture n'était pas sûre est supprimé plutôt qu'affiché : un texte visible sur l'image peut donc manquer entièrement dans le résultat au lieu d'apparaître sous forme de charabia. Il en va de même pour les blocs classés comme image ou bruit, et pour les marques isolées sans lettre ni chiffre. Aucun filtre n'est appliqué aux mots ordinaires peu sûrs : les erreurs de lecture au sein d'un paragraphe subsistent, et c'est à vous de les repérer. Si l'indice de confiance est correct et qu'un morceau de la page manque tout simplement, voilà ce qui s'est passé.
Si vous cherchez autre chose
Rien n'est conservé, mais c'est le seul outil du site dont la première utilisation a un coût : le moteur de lecture pèse quelques mégaoctets et chaque pack de langue un à cinq de plus, téléchargés depuis ce site puis gardés pour la fois suivante. Pour une seule page, l'attente en vaut la peine, mais pas pour deux mille scans planifiés — c'est le travail d'un outil d'OCR de bureau comme OCRmyPDF, qui ajoute une couche de texte à tout un dossier en une commande, sans téléchargement ni clic.
Trois choses ne sont tout simplement pas tentées ici, et mieux vaut les connaître que les découvrir. La perspective n'est pas corrigée — la rotation de la page est mesurée et redressée, mais une photo prise de côté garde sa forme de trapèze : photographier bien à la verticale vaut la seconde de plus. Le seuil qui sépare l'encre du papier est une valeur unique pour toute l'image, et non une par zone : une page à moitié dans l'ombre perdra sa moitié sombre même après l'uniformisation de l'éclairage ; reprenez plutôt la photo sous une lumière homogène. Enfin, un tableau mis en forme par des espaces plutôt que par des bordures n'a aucune bordure à détecter : il est lu comme des colonnes de texte, et ne survit au collage dans un tableur que par chance.
Questions fréquentes
Quelle est la précision ?
Sur un texte imprimé net, photographié bien de face et au point, très bonne — quelques caractères sur mille. La précision baisse avec le flou, les reflets, un faible contraste et les polices inhabituelles, et la page vous indique le degré de certitude de la lecture au lieu de vous laisser deviner. Si ce chiffre est bas, c'est généralement l'image qui pose problème : plus de lumière, moins d'angle et un texte qui remplit le cadre règlent l'essentiel.
Mon image est-elle conservée quelque part ?
Non. Le pack de langue est téléchargé depuis ce site la première fois que vous utilisez une langue ; l'image elle-même n'est jamais conservée ni envoyée nulle part, et l'outil fonctionne donc même avec le Wi-Fi coupé.
Quelles langues peut-il lire ?
Plus de 120, dont l'anglais, le bengali, l'hindi, l'ourdou, l'arabe, l'espagnol, le français, l'allemand, le portugais, le russe, le chinois, le japonais et le coréen. L'écriture est identifiée à partir de l'image elle-même ; lorsque plusieurs langues partagent une écriture — latine, cyrillique, arabe, devanagari — c'est la langue de votre navigateur qui tranche, et vous pouvez toujours la changer.
Les colonnes et le tableau sont-ils conservés ?
Oui, si vous le demandez. Les tableaux à bordures sont détectés et lus cellule par cellule, pour qu'un libellé ne se mélange pas à sa valeur, et ils sont restitués en lignes séparées par des tabulations qui se collent directement dans un tableur. Les colonnes de texte sont lues dans l'ordre de lecture plutôt qu'en travers. Choisir de fusionner les lignes supprime volontairement cette structure, ce qui convient à un paragraphe que vous allez remettre en forme.
Peut-il lire l'écriture manuscrite ?
Une écriture soignée en lettres détachées — des capitales sur un formulaire — passe souvent. L'écriture cursive liée, non, ni ici ni dans aucun autre outil d'OCR généraliste ; honnêtement, c'est un autre problème, qui demande une autre approche. Une page distincte est consacrée à l'écriture manuscrite : elle le dit clairement et vous montre ce qu'elle a réussi à lire.
Quels formats d'image sont acceptés ?
JPG, PNG, WebP, GIF, BMP et SVG via le navigateur lui-même, plus le HEIC d'un iPhone et le TIFF d'un scanner. Une photo prise en mode portrait sur un téléphone ressort dans le bon sens, car l'indicateur d'orientation enregistré par l'appareil est appliqué en premier.
Pourquoi certains mots sont-ils mal lus ?
Presque toujours à cause de l'image plutôt que du texte : un reflet sur la page, l'ombre de votre main, un bougé, ou un texte si petit à l'écran que chaque lettre ne fait que quelques pixels. L'image est mise à l'échelle qui convient le mieux à la lecture, et l'éclairage est uniformisé au préalable, mais aucun traitement n'invente un détail que l'appareil n'a pas capté.
Y a-t-il une limite de taille ?
Seulement la mémoire de votre appareil. Rien n'est conservé, il n'y a donc aucune limite de serveur à atteindre. Une très grande photo est réduite à ce que la lecture peut exploiter — au-delà d'un certain point, davantage de pixels ajoutent du coût sans gain de précision.
Bon à savoir : L'écriture cursive liée n'est reconnue de façon fiable par aucun outil d'OCR généraliste, celui-ci compris. Un texte imprimé sur une image, des lettres très stylisées et un contraste très faible donneront un résultat lacunaire. Le résultat est du texte brut : polices, couleurs, gras et italique ne sont pas repris, pas plus que l'image elle-même.
Intégrez cet outil à votre site
Gratuit pour tout blog, page de cours ou article d'aide. Collez un seul extrait de code et vos visiteurs pourront l'utiliser directement sur votre page.
Outils associés
OCR de capture d'écran
Collez une capture d'écran, récupérez le texte
Scanner un document
Une page photographiée, nettoyée comme un scan
OCR PDF
Rendez un scan interrogeable
Reconnaissance d'écriture manuscrite
L'écriture en capitales, lue honnêtement
Lecteur de QR code
Voyez ce que dit un QR code avant de le suivre
Lecteur de code-barres
Le numéro d'un code-barres, vérifié