Réparer PDF
Sauvez un PDF qui refuse de s'ouvrir. L'index du fichier est reconstruit, et si le document ne peut pas du tout être analysé, tout ce qui reste lisible dans ses octets est récupéré — sans que rien ne soit conservé.
- Jamais conservé
- Pas de file d'attente, pas d'attente
- Sans inscription, sans filigrane
Comment ça marche
Ajoutez le PDF endommagé
Déposez le fichier qui refuse de s'ouvrir. Peu importe que d'autres applications le rejettent.
Réparez
Le fichier est réindexé, ou reconstruit objet par objet s'il ne peut pas être analysé.
Vérifiez et téléchargez
Vous voyez combien de pages ont été récupérées et ce qui a été fait, puis vous téléchargez le fichier réparé.
Ce qui est généralement cassé, et les deux façons de s'en sortir
La plupart des PDF qui refusent de s'ouvrir ne sont pas vraiment endommagés. Un PDF se termine par une table de références croisées — un index qui enregistre la position en octets de chaque objet du fichier — et les visionneuses s'en servent pour trouver quoi que ce soit. Si cet index est corrompu, un document parfaitement intact devient impossible à ouvrir, car rien ne peut être localisé alors que tout est présent. Téléchargement interrompu, enregistrement coupé net, application qui plante, fichier modifié par un logiciel qui n'a pas mis à jour les positions, transfert qui a altéré les fins de ligne : tous cassent l'index, et aucun ne touche au contenu.
La première passe tire parti exactement de cela. Le fichier est analysé avec souplesse, en ignorant les positions annoncées lorsqu'elles ne correspondent pas à ce qui s'y trouve réellement, puis réécrit à neuf avec un index correct, des longueurs de flux correctes et un trailer propre. C'est ce qui récupère la grande majorité des fichiers, c'est rapide, et rien n'est modifié dans les pages — le résultat est votre document, auquel on a simplement remis une table des matières qui fonctionne.
Lorsque le fichier ne peut pas du tout être analysé, la seconde passe fait ce que fait un logiciel de récupération de bureau : elle parcourt les octets bruts du début à la fin à la recherche d'en-têtes d'objets, rassemble tout ce qui ressemble encore à un objet PDF, et reconstruit l'index à partir de ce qui est réellement présent plutôt que de ce que le fichier prétend contenir. La page vous indique laquelle des deux passes a été exécutée, car cela compte — une reconstruction signifie que la structure d'origine était illisible, et le résultat mérite d'être vérifié avant de s'y fier.
Aucune des deux passes ne peut inventer des données absentes, et aucun outil au monde ne le peut. Si un téléchargement s'est arrêté à soixante pour cent, les quarante pour cent de pages restants n'existent pas dans le fichier ; la récupération trouve les pages arrivées et s'arrête là. Si les dégâts se trouvent dans un flux compressé, ce flux ne peut pas être décompressé et la page qu'il dessinait revient blanche, tandis que ses voisines sont intactes. Récupérer une partie d'un document est ici le bon résultat normal, et récupérer à nouveau le fichier d'origine vaut toujours mieux que réparer une copie tronquée.
Si vous cherchez autre chose
qpdf est l'outil de référence pour cela et effectue la même première passe de façon plus approfondie : qpdf --replace-input damaged.pdf réécrit le fichier avec un index correct, et gère les documents chiffrés, les flux d'objets et les fichiers linéarisés sur lesquels une analyse souple peut buter. mutool clean -ggg in.pdf out.pdf va encore plus loin, en reconstruisant l'arborescence des pages et en éliminant tout ce qui n'est pas référencé. Les deux sont gratuits, les deux traitent des fichiers bien plus gros que ce qu'un onglet de navigateur peut contenir, et les deux vous disent ce qu'ils ont dû corriger.
Pour un fichier si endommagé que l'analyse objet par objet est la seule option, Ghostscript est souvent le plus tenace : gs -o repaired.pdf -sDEVICE=pdfwrite broken.pdf interprète le contenu des pages au lieu de simplement le réindexer, ce qui permet parfois de reconstruire des pages que les autres outils abandonnent — au prix d'une réécriture complète, si bien que le résultat n'est plus identique octet pour octet à ce qui avait survécu.
Questions fréquentes
Qu'est-ce qui est réellement réparé ?
La plupart des PDF « corrompus » sont intacts sur le plan structurel, mais leur table de références croisées — l'index qui indique où se trouve chaque objet — est cassée. Téléchargements tronqués, enregistrements interrompus et logiciels de génération défaillants en sont la cause, et les visionneuses refusent le fichier alors que le contenu est toujours là. Reconstruire cet index suffit à faire revenir le document.
Et si le fichier ne peut pas du tout être analysé ?
Les octets bruts sont alors parcourus à la recherche d'en-têtes d'objets, tout ce qui est encore présent est rassemblé, et un nouvel index ainsi qu'un nouveau trailer sont écrits autour — la même récupération qu'effectue un logiciel de bureau. Le résultat est rouvert avant de vous être remis : un fichier qui ne se charge toujours pas est signalé au lieu d'être téléchargé.
Mon fichier endommagé est-il conservé quelque part ?
Non. Même l'analyse de récupération ne conserve rien. Rien n'est envoyé nulle part.
Peut-il récupérer un fichier dont le téléchargement a été interrompu ?
Souvent, oui — jusqu'à l'endroit où les données s'arrêtent. Les pages qui n'ont jamais été téléchargées ne peuvent pas être inventées : vous récupérerez peut-être le début du document plutôt que sa totalité.
Peut-il réparer un PDF protégé par mot de passe ?
Le chiffrement est ignoré pendant la réparation : un fichier protégé ne redeviendra lisible que si vous avez aussi le mot de passe. Utilisez Déverrouiller PDF séparément pour cela.
Bon à savoir : La réparation récupère ce qui se trouve encore dans le fichier — elle ne peut pas reconstituer des données réellement manquantes. Si un document a été tronqué, les pages situées après la coupure sont définitivement perdues. Les fichiers endommagés à l'intérieur de leurs flux compressés peuvent être récupérés avec certaines pages blanches.
Intégrez cet outil à votre site
Gratuit pour tout blog, page de cours ou article d'aide. Collez un seul extrait de code et vos visiteurs pourront l'utiliser directement sur votre page.
Voir aussi : Outils PDF
Compresser PDF
Un fichier plus léger, le même document
Fusionner PDF
Combinez plusieurs PDF en un seul document
PDF en Word
En .docx modifiable, avec OCR pour les scans
OCR PDF
Rendez un scan interrogeable
PDF prêt à imprimer
Format uniforme, fond perdu et traits de coupe
Protéger PDF
Chiffrement par mot de passe, AES-256