Pourquoi coller un document dans un traducteur le casse
Un paragraphe Word n'est pas une simple chaîne de texte. C'est une suite de segments — des passages qui partagent la même police, la même taille et la même couleur —, entre lesquels se trouvent des champs, des signets, des ancres de commentaires, des appels de notes et des images. Copiez le texte, traduisez-le et recollez-le : tout ce qui n'était pas une lettre a disparu — le gras, les liens, le champ de numéro de page, l'appel de note.
La solution évidente, traduire segment par segment, est pire. Les langues n'ordonnent pas les mots de la même façon : « the red house » doit devenir « la maison rouge » — l'adjectif se déplace, et le gras doit se déplacer avec lui. Traduisez les morceaux séparément et vous obtenez « la rouge maison », ce qu'aucun francophone n'écrirait. Chaque paragraphe doit être traduit d'un bloc, sa mise en forme voyageant avec les mots, puis remis en place segment par segment. C'est ce que font ces outils, et c'est pourquoi un mot en gras, un lien hypertexte ou une expression surlignée retombe sur les bons mots dans la traduction.
Tout le reste du fichier — styles, numérotation, mise en page, thèmes, images — n'est jamais réécrit. Le fichier que vous téléchargez est votre original avec d'autres mots dedans, pas un nouveau document construit pour lui ressembler.
Un classeur est un programme, pas seulement du texte
Un classeur pose un problème qu'un document n'a pas : certains de ses mots sont des données auxquelles des formules se comparent. =NB.SI(C:C; "Paid") compte les cellules qui contiennent le mot anglais « Paid ». Traduisez ces cellules en « Payé » et la formule tourne toujours, affiche toujours un nombre, et ce nombre vaut désormais zéro. Les listes déroulantes, les recherches fondées sur un nom de produit et les colonnes de tableau désignées par leur nom échouent de la même manière silencieuse.
Traduire Excel lit donc d'abord chaque formule, liste de validation, tableau croisé dynamique et référence de tableau du classeur, et tout texte dont ils dépendent reste exactement tel quel. La page vous indique combien de cellules cela représente, pour que rien ne soit mis de côté à votre insu. Les noms de feuilles restent aussi, car les formules des autres feuilles et des autres classeurs retrouvent une feuille par son nom.
Ce qui est traduit, c'est tout ce qu'une personne lit : le texte des cellules, les cellules en texte enrichi à la mise en forme mixte, les commentaires et les notes, les formes et les zones de texte, les titres et étiquettes des graphiques. Les nombres, dates, codes et adresses ne sont pas touchés, et un texte répété dans des milliers de cellules n'est traduit qu'une fois, pour se lire de la même façon partout.
La traduction automatique, ce qu'elle vaut vraiment
La traduction utilisée ici est celle que Mozilla a conçue pour la traduction de pages de Firefox : fluide, rapide, et à son meilleur entre l'anglais et les langues européennes les plus parlées. Elle est très bonne pour comprendre un document, rédiger une version destinée à être relue, et traduire le tout-venant — lettres, manuels, listes de prix, rapports — pour lequel personne ne paierait un traducteur.
Elle ne remplace pas un professionnel quand la formulation compte. Une traduction automatique peut produire une phrase qui se lit parfaitement et dit quelque chose de subtilement différent, et elle n'a aucun moyen de connaître la terminologie de votre entreprise. Faites relire par une personne qui maîtrise la langue tout ce qui est juridique, médical, financier ou destiné à l'impression. Un texte court et sans contexte — une colonne de tableur intitulée « Net » ou « Draw » — est le cas le plus difficile pour tout traducteur : jetez donc un coup d'œil aux intitulés.
Les langues sans modèle direct sont traduites en passant par l'anglais. C'est automatique et cela fonctionne généralement bien, mais une nuance peut se perdre deux fois : les paires directes depuis et vers l'anglais restent les plus précises.
Les données de langue, et pourquoi la première traduction est plus longue
La première fois que vous traduisez vers une langue, ses données de langue se téléchargent — entre 15 et 70 MB environ selon la langue, et la page vous indique la taille exacte avant de commencer. Elles sont gardées ensuite, si bien que le document suivant dans la même langue démarre en une seconde ou deux, et vous pouvez les supprimer depuis la page de l'outil quand vous le souhaitez.
C'est aussi pour cela que votre document n'a jamais besoin d'aller où que ce soit. La traduction se fait ici, sur le fichier que vous avez déposé, et la seule chose qui circule, ce sont des données de langue identiques pour tout le monde.