Les traducteurs génériques extraient un flux de texte et cassent tableaux, colonnes et en-têtes. Ici, l’OCR conserve l’ordre de lecture, traite les tableaux comme des grilles et affiche original et traduction à chaque page.
La plupart des traducteurs web rendent un mur de texte. Ici, l’ordre des paragraphes, les tableaux et la relecture bilingue restent visibles avant paiement.
Les résultats promettent un PDF au pixel près. Sur un scan, le vrai test : les tableaux restent des grilles, et vous comparez original et traduction avant export.
| Comparison criteria | Google / générique | Promesses « 99 % » | Cette relecture OCR |
|---|---|---|---|
PDF scanné | Échoue souvent | Mieux sur PDF natif | OCR + relecture bilingue |
Tableaux | Mur de texte | Meilleur sur fichier numérique | Restent des grilles |
Articles en deux colonnes | Les colonnes fusionnent | Selon l’outil | Ordre de lecture rétabli |
Lorsque le format est cassé, le contexte l'est aussi. Un tableau traduit qui perd l'alignement de ses colonnes est plus difficile à vérifier qu'une absence de traduction.
Les en-têtes de colonnes, les étiquettes de lignes et l'alignement des cellules sont conservés. Les états financiers et les tableaux de données traduits restent lisibles.
Les articles universitaires à deux colonnes et les documents de style journal conservent leur structure visuelle au lieu de s'effondrer en une seule colonne.
Le texte original et le texte traduit apparaissent l'un à côté de l'autre sur chaque page. Repérez les erreurs d'OCR et les lacunes de traduction sans perdre le fil.
Les en-têtes de chapitres, les sections numérotées et les sauts de paragraphes sont reportés dans la traduction afin que la structure du document reste navigable.
Les traducteurs de PDF standards extraient le texte brut et perdent la structure. L'OCR page par page maintient les repères de mise en page attachés à chaque bloc de contenu.

Le fichier peut être un document numérisé, un PDF composé uniquement d'images ou une page photographiée : aucun texte sélectionnable n'est requis.

Le texte est extrait avec l'ordre de lecture et les limites des paragraphes. Les tableaux sont reconnus comme des groupes de cellules, et non comme des fragments de texte dispersés.

Le contenu traduit est placé à côté de l'original. Révisez les deux versions avant d'exporter : rien n'est remplacé de manière irréversible.
Certains documents sont illisibles sans structure. Ce sont ceux pour lesquels une traduction préservant la mise en page n'est pas optionnelle.
Un bilan dont les colonnes sont mal alignées est inutile. Conservez les colonnes de devises, les sous-totaux et les étiquettes de lignes tout au long de la traduction.
Les documents de recherche avec des citations, des notes de bas de page et des mises en page multicolonnes doivent avoir le même aspect dans la traduction que dans l'original.
Les clauses numérotées, les sous-clauses en retrait et les références de paragraphes doivent survivre intactes à la traduction pour que le document reste juridiquement traçable.
Les dessins d'ingénierie, les fiches techniques et les tableaux de spécifications contenant du texte et des figures mélangés nécessitent un OCR minutieux pour éviter de brouiller la structure.
Si vous n'avez pas trouvé la réponse que vous cherchiez, n'hésitez pas à nous la poser !
Téléversez quelques pages pour un aperçu gratuit. Vérifiez la qualité de l'OCR, la structure des tableaux et l'adaptation de la traduction. Continuez avec le document complet uniquement si le résultat correspond à vos besoins.
Scan de 100 pages ? Utilisez le traducteur de PDF volumineux. Même OCR, conçu pour les fichiers longs.