Convertir TIFF en TXT

Vous pouvez convertir TIFF en TXT gratuitement et sans compte : déposez le fichier ci-dessus et, une ou deux secondes plus tard, le résultat est prêt à télécharger. La conversion se fait dans votre propre navigateur : le fichier n’est donc jamais téléversé. Cela marche sous Windows, macOS et Linux comme sur iPhone et Android, et continue de marcher si vous coupez le réseau.

  • Où cela s’exécute Dans votre navigateur. Le fichier n’est pas téléversé.
  • Reconstruit TXT ne fonctionne pas comme TIFF. Il ne s’agit donc pas de la dégradation progressive d’un codec avec perte : ce que TXT sait exprimer est reproduit fidèlement, et ce qui n’y a pas d’équivalent ne subsiste pas du tout.
  • Limite de taille Jusqu’à 100 Mo par fichier, gratuitement et sans compte.
  • Bon à savoir Le texte est lu par reconnaissance de formes : c’est donc une hypothèse motivée et non une transcription. Une typographie nette, droite, bien éclairée et à résolution correcte ressort presque parfaite ; une photo prise de biais, un fax pâle, une police inhabituelle ou une écriture manuscrite produiront des erreurs. Relisez toujours le résultat face à l’original avant de vous y fier. Le réglage de langue compte : avec le mauvais, ce sont des absurdités très assurées qui reviennent, et non un message d’erreur.

Jusqu’à 100 fichiers à la fois. Les formats mélangés ne posent pas de problème.

C’est du travail d’archives, pas une photo de téléphone

Presque rien n’arrive en TIFF par accident. Cela vient d’un scanner, d’un système de gestion documentaire, d’un service d’archives, d’un fax — et c’est en général de la paperasse : contrats, correspondance, sinistres, dossiers juridiques, dossiers médicaux, procès-verbaux.

Cela change la nature du travail. Personne n’essaie de recopier un paragraphe sur une image ; quelqu’un essaie de rendre un fonds de documents cherchable, ou de sortir du texte à citer d’une archive, ou d’extraire des chiffres d’une pile de formulaires. Le volume est plus élevé et la précision compte davantage.

Un scan est une bien meilleure entrée qu’une photo

Tout ce qui rend une photo de téléphone difficile est absent. La page est à plat contre la vitre, donc pas de perspective. L’éclairage est régulier, donc pas d’ombre sur le texte. La résolution est connue et constante. Et un scanner est mis au point à la bonne distance par construction.

La conséquence pratique, c’est que du texte imprimé propre scanné à 300 points par pouce sort presque parfait. C’est une attente réellement plus haute que ce que les pages de photos du site peuvent offrir, et c’est pourquoi le travail de reconnaissance en volume se fait à partir de scans plutôt qu’à partir de photos.

Là où les scans échouent encore

La résolution d’abord. En dessous d’environ 200 points par pouce, il n’y a pas assez de pixels par caractère et la précision s’effondre ; 300 points par pouce est la norme de travail et 600 vaut la peine pour les petites polices ou les originaux en mauvais état.

Puis l’original lui-même. Les fax sont le pire cas courant — faible résolution par construction, souvent plusieurs générations de copie en profondeur. Les carbones, le papier thermique qui a pâli, les documents avec des tampons ou de l’écriture manuscrite par-dessus l’imprimé, et les faces de machine à écrire aux caractères abîmés produisent tous des erreurs. Idem pour un scan sorti de travers, qu’il vaut mieux redresser avant la reconnaissance qu’après.

Seule la première page d’un TIFF multipage est reconnue

Un scanner produit fréquemment un seul TIFF contenant toutes les pages d’un document. Seule la première image du fichier est lue, et il n’y a pas de contrôle de page pour passer au-delà, si bien qu’un scan de dix pages ne rend que le texte de la première et rien d’autre. Rien n’annonce les neuf autres — la sortie s’arrête, tout simplement.

Sur des documents scannés page par page, cela ne coûte rien. Sur un dossier, c’est le moment où la réponse honnête est qu’il faut séparer les pages avant qu’elles n’arrivent ici, par le scanner ou par le système d’archives qui a écrit le TIFF. Cette page est pour les documents que vous avez réellement besoin de lire maintenant, pas pour numériser un fonds de classeurs.

La sortie est une supposition sans signal d’erreur

La reconnaissance compare des formes à des graphies. Elle ne comprend pas le document et elle ne peut pas dire où elle a hésité, si bien que ce qui revient est un texte fluide et complet qui peut contenir des erreurs que personne n’a marquées.

Dans un travail d’archives, cela compte plus que d’habitude. Un chiffre mal lu dans un numéro de police, une date, un montant ou une référence de dossier est exactement l’erreur qui survit à une lecture rapide et qui cause un vrai problème plus tard. Tout ce qui va dans un système, un dossier ou une citation mérite d’être vérifié en regard de la page dont il vient.

Un PDF cherchable est souvent le meilleur objectif

Pour une archive, le texte brut jette ce qui fait qu’un scan mérite d’être gardé : l’image de la page, qui est la pièce. Un PDF cherchable conserve cette image et place une couche de texte derrière, si bien que le document ressemble encore à lui-même, s’imprime encore comme lui-même, et peut être cherché et copié.

Le texte brut est la bonne sortie quand on veut les mots comme mots — à citer, à indexer, à verser dans quelque chose, à compter. Cela vaut la peine de décider lequel des deux on a réellement besoin avant de convertir cent fichiers, parce que les deux chaînes divergent tout de suite.

Les scans ne quittent pas votre machine

La reconnaissance se passe dans l’onglet du navigateur sur votre propre processeur. Rien n’est téléversé, si bien qu’il n’y a pas de copie serveur, pas de période de rétention à demander, pas de compte, pas de plafond journalier.

Vu ce qui se trouve en général dans ces fichiers — contrats signés, dossiers patients, actes de procédure, déclarations de sinistre — c’est la différence substantielle avec un service hébergé plutôt qu’une ligne parmi les fonctions. Cela évite aussi la question embarrassante de savoir si envoyer les documents d’un client à un tiers demandait la permission de quiconque.

Reconnaître toute une pile, et la patience qu’il faut

Le reconnaisseur tourne fichier par fichier, et la sortie d’une pile est la concaténation des résultats. Le tout peut prendre un moment sur un grand dossier, parce que la reconnaissance est le moteur le plus lent du site par une marge nette — plusieurs secondes par page, davantage sur un scan à haute résolution.

Pour une archive entière, l’attente est en général négligeable devant la valeur de disposer du texte : pouvoir chercher dans le fonds, indexer, extraire des citations, compter. Sur un ou deux documents, l’attente peut sembler disproportionnée — et la bonne réponse est alors la question de savoir si une autre voie (un logiciel avec un meilleur OCR pour le cas particulier, ou simplement lire la page) ne serait pas plus rapide.

Comment convertir TIFF en TXT

  1. Déposez votre fichier TIFF sur cette page, ou cliquez pour en choisir un.
  2. Choisissez TXT comme destination. La conversion se fait dans votre navigateur et le fichier n’est pas téléversé.
  3. Téléchargez le fichier TXT terminé.

TIFF et TXT : ce qui change

TIFF face à TXT
TIFFTXT
Nom completTagged Image File FormatTexte brut
Extension de fichier.tif, .tiff.txt, .text, .log
Type de médiaimage/tifftext/plain
CompressionSans perte — rien n’est écarté
Première publication19861963
Publié parAdobe
SpécificationTIFF 6.0Unicode
LicencePublié, non normaliséStandard ouvert
Situation actuelleActuelActuel
Profondeur de bits32
Couleur qu’il peut décrireRVB, CMJN, niveaux de gris, Lab
S’ouvre dans un navigateurCertains navigateursTous les navigateurs
Envisagé à la placePNG, PDF, DNGMD, RTF

Ouvrir le résultat

TXT s’ouvre dans tous les navigateurs actuels. TIFF va encore moins loin. Si le fichier part sur une page web ou dans un formulaire, c’est souvent toute la raison de la conversion.

Les logiciels habituels ne se recoupent pas : TIFF s’ouvre dans Adobe Photoshop, Affinity Photo et ImageMagick, TXT dans Notepad, TextEdit et Visual Studio Code — celui qui reçoit le résultat a donc besoin d’un logiciel de la seconde liste.

À quoi sert chaque format

TIFF est le format de Adobe, publié en 1986. L’enregistrement se fait sur 32 bits par canal.

TXT date de 1963, décrit par Unicode. Notepad, TextEdit et Visual Studio Code le lisent.

TXT a été publié en 1963 et TIFF en 1986. Le plus ancien est en général le fichier le plus sûr à remettre ; le plus récent fait le même travail en moins d’octets.

De TIFF à TXT : questions fréquentes

Mon fichier TIFF est-il téléversé quelque part ?

Non. Cette conversion se fait entièrement dans votre navigateur : le fichier ne quitte donc pas votre appareil. Vous pouvez le vérifier vous-même — ouvrez l’onglet réseau des outils de développement et convertissez quelque chose. Vous verrez la page elle-même et les requêtes de statistiques et de publicité qui financent ce service, et pas une seule qui transporte votre fichier. Le moteur de cette paire précise est Tesseract, le moteur libre de reconnaissance de texte ; votre navigateur le télécharge une fois puis le garde en cache.

Convertir TIFF en TXT est-il gratuit ?

Oui. Pas de compte, pas de filigrane et pas de quota journalier à dépenser : cela tourne sur votre propre machine, vous pouvez donc revenir autant de fois que vous voulez. Le navigateur traite des fichiers jusqu’à 100 Mo, 100 à la fois. Tesseract est téléchargé sur votre machine et s’y exécute, et c’est pourquoi rien n’est compté.

Y a-t-il une perte de qualité en convertissant TIFF en TXT ?

TIFF et TXT décrivent le contenu de façons radicalement différentes. La conversion est donc une reconstitution et non une copie : fidèle, mais pas identique octet pour octet. Le texte est lu par reconnaissance de formes : c’est donc une hypothèse motivée et non une transcription. Une typographie nette, droite, bien éclairée et à résolution correcte ressort presque parfaite ; une photo prise de biais, un fax pâle, une police inhabituelle ou une écriture manuscrite produiront des erreurs. Relisez toujours le résultat face à l’original avant de vous y fier. Le réglage de langue compte : avec le mauvais, ce sont des absurdités très assurées qui reviennent, et non un message d’erreur.

Dois-je installer quelque chose pour ouvrir un fichier TXT ?

Pas pour la conversion : elle se fait dans le navigateur que vous avez déjà ouvert. Pour ouvrir le résultat, il vous faut ensuite le logiciel avec lequel votre appareil affiche habituellement Plain Text.

En savoir plus sur ces formats

D’où viennent ces chiffres

Ce que cette page affirme sur TIFF et TXT se vérifie : voici les documents qui le fixent.

  • TIFF, Revision 6.0

    Library of Congress, Sustainability of Digital Formats — La structure en étiquettes du TIFF et ses nombreuses méthodes de compression