TIFF in TXT umwandeln

TIFF kannst du hier kostenlos und ohne Konto in TXT umwandeln: Datei oben ablegen, und ein, zwei Sekunden später steht das Ergebnis zum Herunterladen bereit. Die Umwandlung läuft in deinem eigenen Browser, die Datei wird also nie hochgeladen — das klappt unter Windows, macOS und Linux ebenso wie auf iPhone und Android, und es funktioniert selbst dann noch, wenn du das Netz abschaltest.

  • Wo es läuft In deinem Browser. Die Datei wird nicht hochgeladen.
  • Neu aufgebaut TXT funktioniert anders als TIFF. Es ist also nicht der schleichende Qualitätsverlust eines verlustbehafteten Codecs: Was TXT ausdrücken kann, wird originalgetreu wiedergegeben — was dort keine Entsprechung hat, bleibt ganz weg.
  • Größenbegrenzung Bis 100 MB pro Datei, kostenlos und ohne Konto.
  • Gut zu wissen Der Text wird über Mustererkennung gelesen — das ist eine begründete Vermutung und keine Abschrift. Saubere, gerade, gut ausgeleuchtete Schrift in ordentlicher Auflösung kommt nahezu fehlerfrei heraus; ein schräg fotografiertes Blatt, ein blasses Fax, eine ungewöhnliche Schrift oder Handschrift erzeugen Fehler. Lies das Ergebnis vor dem Weiterverwenden immer gegen das Original. Die Spracheinstellung zählt dabei: Mit der falschen kommt überzeugend aussehender Unsinn zurück statt einer Fehlermeldung.

Bis zu 100 Dateien auf einmal. Gemischte Formate sind kein Problem.

TIFF kommt selten vom Fotografieren, meist vom Scannen oder Faxen

Kaum jemand erzeugt eine TIFF-Datei aus Versehen. Sie kommt aus einem Dokumentenscanner, einer Kanzleisoftware, einem Aktenarchiv — oder, in Deutschland nach wie vor häufiger als man denkt, aus einem Faxgerät. Arztpraxen, Notariate und öffentliche Verwaltungen faxen weiterhin, und viele Fax-to-Mail-Gateways legen das Empfangene als TIFF ab, weil das Format aus derselben Zeit stammt wie die Faxnorm selbst.

Damit ist klar, worum es hier geht: nicht um einen Urlaubsschnappschuss, sondern um Schriftgut. Verträge, Schriftwechsel, Anträge, Protokolle. Die Erwartung an die Genauigkeit ist entsprechend höher, und die Menge auch — wer TIFF-Dateien stapelweise vorliegen hat, will sie durchsuchbar machen, nicht einzeln lesen.

Ein Scan ist ein deutlich besseres Ausgangsmaterial als ein Foto

Alles, was ein Handyfoto schwer lesbar macht, fällt bei einem Scan weg. Die Vorlage liegt plan auf der Glasplatte, es gibt keinen Schrägwinkel und keinen Schlagschatten, die Auflösung ist bekannt und gleichbleibend, und der Scanner ist von Bauart aus exakt fokussiert.

Sauber gedrucktes Schriftbild bei 300 dpi kommt deshalb fast fehlerfrei zurück — ein Ergebnis, das eine Fotoaufnahme derselben Seite kaum je erreicht. Das ist auch der Grund, warum Massenerkennung in Archiven grundsätzlich vom Scan und nicht vom Foto ausgeht.

Wo selbst der Scan noch scheitert

Zuerst die Auflösung. Unter etwa 200 dpi fehlen schlicht die Pixel pro Zeichen, und die Trefferquote bricht ein; 300 dpi ist der übliche Standard, 600 lohnt sich bei kleiner Schrift oder schlechten Vorlagen. Ein per Fax empfangenes TIFF liegt oft nahe an dieser unteren Grenze, weil die klassische Faxnorm selbst nicht mehr auflöst.

Dann die Vorlage: Durchschläge, verblasstes Thermopapier, Stempel oder handschriftliche Vermerke über dem Druck, Schreibmaschinenschrift mit ausgeschlagenen Typen — all das erzeugt Fehler, die keine Einstellung hier beheben kann. Ein schräg eingezogener Scan lässt sich vor der Erkennung leichter korrigieren als danach.

Nur die erste Seite einer mehrseitigen TIFF wird gelesen

Scanner legen ein ganzes Dokument häufig in einer einzigen TIFF-Datei mit mehreren Seiten ab. Gelesen wird ausschließlich das erste Bild darin, eine Seitenauswahl gibt es an dieser Stelle nicht — ein zehnseitiger Vertrag liefert also den Text von Seite eins und sonst nichts. Es erscheint auch keine Meldung dazu; die Ausgabe hört einfach auf.

Bei Dokumenten, die Seite für Seite als eigene Datei gescannt wurden, kostet das nichts. Bei einem Stapel ist die ehrliche Antwort, dass die Seiten vor diesem Schritt getrennt werden müssen — vom Scanner selbst oder von der Software, die das TIFF geschrieben hat. Diese Seite ist für einzelne Dokumente gedacht, nicht zum Digitalisieren eines ganzen Aktenschranks.

Deutsche Umlaute und das ß sind mit erkannt, nicht nur erraten

Die Texterkennung, die hier läuft, ist eigens für vier Sprachen trainiert — Englisch, Deutsch, Französisch, Spanisch — und lädt bei Bedarf das jeweilige Sprachmodell nach. Für ein deutsches Schriftstück heißt das: ä, ö, ü und ß gehören zum trainierten Alphabet und werden als eigene Zeichen erkannt, nicht als bester Treffer aus einem Zeichensatz, der sie gar nicht kennt.

Voraussetzung ist, dass Deutsch vor dem Umwandeln auch tatsächlich eingestellt wird. Bleibt es bei der Grundeinstellung Englisch, sucht die Erkennung weiter im englischen Alphabet nach dem nächstbesten Treffer, und aus einem ß wird dann leicht ein ß, das wie B gelesen wurde, oder ein Umlaut, der als zwei Buchstaben zurückkommt.

Das Scanbild ist oft der wichtigere Teil, der Text nur die Zugabe

Für ein Archiv wirft reiner Text das Wichtigste weg: das Abbild der Seite, das eigentlich der Beleg ist. Wer geschäftliche Unterlagen revisionssicher aufbewahren muss — die GoBD verlangen genau das für Buchungsbelege — braucht das Bild der Seite, nicht nur ihren Inhalt in Buchstaben.

Klartext ist die richtige Wahl, wenn die Wörter selbst gebraucht werden: zum Zitieren, zum Indizieren, zum Weiterverarbeiten in einer anderen Software. Diese Entscheidung lohnt sich vor dem ersten von hundert Dokumenten, nicht danach, weil beide Wege sich sofort trennen.

Die Erkennung rät und sagt nicht, wo sie sich nicht sicher war

Erkennung vergleicht Formen mit Buchstabenformen. Sie versteht das Dokument nicht und kann nirgends anmerken, wo sie unsicher war — was zurückkommt, ist flüssiger, fertig aussehender Text, der Fehler enthalten kann, ohne dass irgendetwas darauf hindeutet.

Bei Aktenmaterial fällt das mehr ins Gewicht als sonst. Eine falsch gelesene Ziffer in einer Aktenzeichennummer, einem Datum oder einem Betrag ist genau die Art Fehler, die einen flüchtigen Blick übersteht und später ein echtes Problem wird. Alles, was in eine Akte, einen Schriftsatz oder ein System übernommen wird, gehört gegen die Vorlage geprüft.

Warum Tabellen und Formulare hier ihre Ordnung verlieren

Die Ausgabe ist reiner Text in Lesereihenfolge, ohne jede Vorstellung von Spalten oder Feldern. Eine Tabelle wird zu einer Kette von Werten ohne Trennung, und ein Formular setzt Bezeichnung und Eintrag in eine Reihenfolge, die sich hinterher nur mühsam wieder auseinanderklamüsern lässt.

Rechnen sollte man mit Nacharbeit, nicht mit einem fertigen Ergebnis. Wer regelmäßig Formulare mit gleichbleibendem Aufbau erkennen lässt, gewinnt am meisten dadurch, dass er die Position der wichtigen Felder vorher kennt und danach gezielt sucht, statt den ganzen Text von oben zu lesen.

Warum gerade diese Dokumente den Rechner nicht verlassen sollten

Die Erkennung läuft vollständig im eigenen Browser, auf dem eigenen Prozessor. Es gibt keinen Server, der die Datei zwischenzeitlich hält, keine Aufbewahrungsfrist, über die man sich Gedanken machen müsste, kein Konto und keine Tagesgrenze.

Bei dem, was typischerweise als TIFF vorliegt — unterschriebene Verträge, Patientenunterlagen, gerichtliche Schriftstücke, Mandantenakten unter anwaltlicher Schweigepflicht — ist das kein Komfortmerkmal, sondern der eigentliche Punkt. Es erübrigt sich auch die Frage, ob das Versenden fremder Unterlagen an einen Dritten überhaupt jemandes Erlaubnis gebraucht hätte.

Was die Erkennung nicht liefert und nicht liefern soll

Es gibt keine Formatierung, keine Absatzstruktur außer den Zeilenumbrüchen, die die Erkennung selbst gesetzt hat, kein hOCR und keine Koordinaten der erkannten Wörter. Was zurückkommt, ist eine Textdatei und nichts, was sich als Layout wiederverwenden ließe.

Eine durchsuchbare PDF-Datei — Seitenbild und Textebene in einer Datei — entsteht hier nicht; das ist eine andere Aufgabe als das, was diese Seite tut. Wer beides braucht, das Bild als Beleg und den Text zum Suchen, sollte danach getrennt schauen, wie sich beides zusammenführen lässt, statt es von dieser einen Umwandlung zu erwarten.

Wann reiner Text die richtige Wahl ist

Immer dann, wenn die Wörter das Ziel sind: ein Zitat aus einem alten Schreiben, ein Suchindex über einen Aktenbestand, eine Weiterverarbeitung in einer anderen Anwendung. Für einzelne, klar lesbare Dokumente liefert diese Umwandlung schnell ein brauchbares Ergebnis.

Für einen ganzen Aktenschrank, für mehrseitige Faxeingänge oder für alles, bei dem das Seitenbild selbst der Beleg bleiben muss, ist reiner Text nur die halbe Lösung. Dann lohnt es sich, vorher festzulegen, welche der beiden Aufgaben — durchsuchen oder archivieren — gerade wirklich ansteht.

TIFF in TXT umwandeln — so geht es

  1. Leg deine TIFF-Datei auf dieser Seite ab, oder klick, um eine auszuwählen.
  2. Wähl TXT als Ziel. Die Umwandlung läuft in deinem Browser, die Datei wird nicht hochgeladen.
  3. Lade die fertige TXT-Datei herunter.

TIFF und TXT im Vergleich: was sich ändert

TIFF im Vergleich zu TXT
TIFFTXT
Vollständiger NameTagged Image File FormatReiner Text
Dateiendung.tif, .tiff.txt, .text, .log
Medientypimage/tifftext/plain
KompressionVerlustfrei — es wird nichts verworfen
Erstmals veröffentlicht19861963
Herausgegeben vonAdobe
SpezifikationTIFF 6.0Unicode
LizenzlageVeröffentlicht, nicht standardisiertOffener Standard
Heutiger StandAktuellAktuell
Bittiefe32
Kann Farbe beschreiben alsRGB, CMYK, Graustufen, Lab
Öffnet im BrowserManche BrowserJeder Browser
Stattdessen erwogenPNG, PDF, DNGMD, RTF

Das Ergebnis öffnen

TXT öffnet sich in jedem aktuellen Browser. TIFF unterstützen noch weniger Browser. Wenn die Datei auf eine Webseite oder in ein Formular soll, ist das meist der ganze Grund für die Umwandlung.

Die üblichen Programme überschneiden sich nicht: TIFF öffnest du in Adobe Photoshop, Affinity Photo und ImageMagick, TXT in Notepad, TextEdit und Visual Studio Code — wer das Ergebnis bekommt, braucht also eines aus der zweiten Reihe.

Wofür die beiden Formate gedacht sind

TIFF stammt von Adobe und wurde 1986 veröffentlicht. Aufgezeichnet wird mit 32 Bit pro Kanal.

TXT stammt aus 1963, festgehalten in Unicode. Notepad, TextEdit und Visual Studio Code lesen das Format.

TXT wurde 1963 veröffentlicht, TIFF 1986. Das ältere ist in der Regel die sicherere Datei zum Weitergeben, das jüngere erledigt dieselbe Aufgabe mit weniger Bytes.

TIFF zu TXT: häufige Fragen

Werden meine TIFF-Dateien irgendwo hochgeladen?

Nein. Diese Umwandlung läuft vollständig in deinem Browser, die Datei verlässt dein Gerät also nicht. Du kannst das selbst nachprüfen: Öffne den Netzwerk-Tab der Entwicklerwerkzeuge und wandle etwas um. Zu sehen sind die Seite selbst und die Statistik- und Werbeanfragen, mit denen dieser Dienst bezahlt wird — und keine einzige, die deine Datei trägt. Hinter genau diesem Paar steckt Tesseract, die quelloffene Texterkennung; dein Browser lädt das einmal und behält es dann.

Ist das Umwandeln von TIFF in TXT kostenlos?

Ja. Kein Konto, kein Wasserzeichen und kein Tageskontingent, das sich verbraucht — es läuft auf deinem eigenen Rechner, du darfst also so oft wiederkommen, wie du willst. Dateien bis 100 MB verarbeitet der Browser, 100 auf einmal. Tesseract wird auf deinen Rechner geladen und läuft dort — deshalb gibt es dafür keine Zählung.

Geht beim Umwandeln von TIFF in TXT Qualität verloren?

TIFF und TXT beschreiben Inhalte auf grundverschiedene Weise. Die Umwandlung ist deshalb ein Nachbau und keine Kopie: originalgetreu, aber nicht Byte für Byte dasselbe. Der Text wird über Mustererkennung gelesen — das ist eine begründete Vermutung und keine Abschrift. Saubere, gerade, gut ausgeleuchtete Schrift in ordentlicher Auflösung kommt nahezu fehlerfrei heraus; ein schräg fotografiertes Blatt, ein blasses Fax, eine ungewöhnliche Schrift oder Handschrift erzeugen Fehler. Lies das Ergebnis vor dem Weiterverwenden immer gegen das Original. Die Spracheinstellung zählt dabei: Mit der falschen kommt überzeugend aussehender Unsinn zurück statt einer Fehlermeldung.

Muss ich etwas installieren, um TXT-Dateien zu öffnen?

Für die Umwandlung selbst nicht — sie läuft in dem Browser, den du ohnehin offen hast. Zum Öffnen brauchst du danach das Programm, das auf deinem Gerät üblicherweise Plain Text anzeigt.

Mehr über diese Formate

Woher diese Zahlen stammen

Was diese Seite über TIFF und TXT behauptet, lässt sich nachprüfen — hier stehen die Dokumente, die es festlegen.

  • TIFF, Revision 6.0

    Library of Congress, Sustainability of Digital Formats — Der Tag-Aufbau von TIFF und seine vielen Kompressionsverfahren