Cookies voor statistiek en advertenties
We gebruiken cookies voor statistiek en voor advertenties, allebei naar Google. Weigeren verandert niets aan wat je te zien krijgt.Lees de privacypagina
Hier zet je TIFF naar TXT om, gratis en zonder account: sleep het bestand hierboven erin en binnen een paar seconden staat het resultaat klaar om te downloaden. De omzetting gebeurt binnen je eigen browser, dus het bestand wordt nooit geüpload. Het werkt hetzelfde op Windows, macOS en Linux als op iPhone en Android, en het blijft werken als je de verbinding verbreekt.
Tot 100 bestanden tegelijk. Verschillende formaten door elkaar is prima.
Ze worden een voor een omgezet en samen in één ZIP gedownload.
TIFF naar TXT
Vrijwel niets komt per ongeluk als TIFF binnen. Het komt van een scanner, een documentbeheersysteem, een archief- of records-afdeling, of een faxpoort — en het is meestal papierwerk: contracten, correspondentie, claims, dossiers, medische gegevens, notulen.
Dat verandert wat de klus is. Niemand probeert een alinea van een foto over te typen; iemand probeert een reeks documenten doorzoekbaar te maken, of citeerbare tekst uit een archief te halen, of cijfers uit een stapel formulieren. De omvang is groter en de nauwkeurigheid telt zwaarder.
Alles wat een telefoonfoto lastig maakt, ontbreekt. De pagina ligt vlak tegen glas, dus is er geen perspectief. De belichting is gelijkmatig, dus is er geen schaduw over de tekst. De resolutie is bekend en consistent. En een scanner staat door constructie precies op de juiste afstand scherp.
Het praktische resultaat is dat schoon gedrukte letters op 300 dpi bijna perfect terugkomen. Dat is echt een hogere verwachting dan de fotopagina's op deze site kunnen bieden, en het is waarom herkenningswerk op schaal gedaan wordt uit scans en niet uit foto's.
Resolutie eerst. Onder ongeveer 200 dpi zijn er niet genoeg beeldpunten per teken en valt de nauwkeurigheid snel weg; 300 dpi is de werkstandaard en 600 is de moeite waard voor klein lettertype of slechte originelen.
Dan het origineel zelf. Faxen zijn het slechtste gewone geval — laag opgelost naar ontwerp, vaak meerdere kopieergeneraties diep. Doorslagen, verkleurd thermisch papier, documenten met stempels of handschrift over de druk, en typemachineletters met kapotte tekens leveren allemaal fouten op. Net als een scan die scheef is uitgekomen, wat je beter voor de herkenning corrigeert dan erna.
Een scanner produceert vaak één TIFF met elke pagina van een document erin. Alleen het eerste beeld in het bestand wordt gelezen, en er is geen paginaregelaar om verder te komen, dus geeft een scan van tien pagina's de tekst van pagina één terug en verder niets. Niets kondigt de andere negen aan — de uitvoer stopt gewoon.
Bij documenten die per pagina gescand zijn kost dat niets. Bij een bundel is dit het punt waarop het eerlijke antwoord is dat de pagina's gescheiden moeten worden voordat ze hier komen, door de scanner of het dossiersysteem dat de TIFF schreef. Deze pagina is voor de documenten die je nu echt moet lezen, niet voor het digitaliseren van een archiefkast.
Herkenning matcht vormen tegen letterbeelden. Het begrijpt het document niet en kan niet aangeven waar het onzeker was, dus wat terugkomt is vloeiende, compleet ogende tekst die fouten kan bevatten die niemand markeerde.
In archiefwerk telt dat zwaarder dan gewoonlijk. Een verkeerd gelezen cijfer in een polisnummer, een datum, een bedrag of een dossiernummer is precies de fout die een vluchtige lezing overleeft en later een echt probleem veroorzaakt. Alles dat een systeem, een bundel of een citaat in gaat, moet tegen de pagina waar het vandaan komt gecheckt worden.
Voor een archief gooit platte tekst weg wat een scan het bewaren waard maakt: het beeld van de pagina, wat de vastlegging is. Een doorzoekbare PDF houdt dat beeld en zet er een tekstlaag achter, dus blijft het document er nog steeds als zichzelf uitzien, drukt het nog steeds als zichzelf af, en is het doorzoekbaar en kopieerbaar.
Platte tekst is de juiste uitvoer als je de woorden zelf wilt — om te citeren, te indexeren, ergens in te voeren, te tellen. Het is de moeite waard om te beslissen welke van de twee je echt nodig hebt voordat je honderd bestanden omzet, want de twee werkwijzen lopen meteen uiteen.
Herkenning gebeurt in het browsertabblad op je eigen processor. Er wordt niets geüpload, dus is er geen serverkopie, geen bewaartermijn om over te vragen, geen account en geen daglimiet.
Gezien wat er typisch in deze bestanden staat — getekende contracten, patiëntgegevens, gerechtelijke stukken, verzekeringsclaims — is dat het inhoudelijke verschil met een gehoste dienst en geen kenmerk uit een productbeschrijving. Het haalt ook de lastige vraag weg of het sturen van de documenten van een cliënt naar een derde partij iemands toestemming nodig had.
| TIFF | TXT | |
|---|---|---|
| Volledige naam | Tagged Image File Format | Platte tekst |
| Bestandsextensie | .tif, .tiff | .txt, .text, .log |
| Mediatype | image/tiff | text/plain |
| Compressie | Zonder verlies — er gaat niets weg | — |
| Voor het eerst gepubliceerd | 1986 | 1963 |
| Uitgegeven door | Adobe | — |
| Specificatie | TIFF 6.0 | Unicode |
| Licentie | Gepubliceerd, niet gestandaardiseerd | Open standaard |
| Stand van zaken | Actueel | Actueel |
| Bitdiepte | 32 | — |
| Kleur die het kan beschrijven | RGB, CMYK, grijswaarden, Lab | — |
| Opent in een browser | Sommige browsers | Elke browser |
| In plaats daarvan overwogen | PNG, PDF, DNG | MD, RTF |
TXT opent in elke actuele browser. TIFF komt nog minder ver. Gaat het bestand naar een webpagina of een formulier, dan is dat meestal de hele reden voor de omzetting.
De gebruikelijke programma's overlappen niet: TIFF open je in Adobe Photoshop, Affinity Photo en ImageMagick, TXT in Notepad, TextEdit en Visual Studio Code — wie het resultaat krijgt, heeft dus iets uit de tweede rij nodig.
TIFF is het formaat van Adobe, verschenen in 1986. Er wordt met 32 bits per kanaal vastgelegd.
TXT stamt uit 1963, vastgelegd in Unicode. Notepad, TextEdit en Visual Studio Code lezen het formaat.
TXT verscheen in 1963 en TIFF in 1986. Het oudste is doorgaans het veiligste bestand om te overhandigen; het nieuwste doet hetzelfde werk met minder bytes.
Nee. Deze omzetting gebeurt volledig in je browser, dus het bestand verlaat je apparaat niet. Je kunt het zelf nagaan: open het netwerktabblad van de ontwikkelaarshulpmiddelen en zet iets om. Je ziet de pagina zelf en de verzoeken voor statistiek en advertenties waarmee deze dienst betaald wordt, en geen enkel verzoek dat je bestand meeneemt. De motor achter juist dit paar is Tesseract, de opensource-tekstherkenning; je browser haalt die één keer op en bewaart hem.
Ja. Geen account, geen watermerk en geen dagtegoed dat opraakt: het draait op je eigen machine, dus je mag zo vaak terugkomen als je wilt. De browser verwerkt bestanden tot 100 MB, 100 tegelijk. Tesseract wordt naar je eigen machine gehaald en draait daar, en daarom staat er geen teller op.
TIFF en TXT beschrijven de inhoud op fundamenteel andere manieren. De omzetting is daarom een reconstructie en geen kopie: getrouw, maar niet byte voor byte identiek. De tekst wordt gelezen door patroonherkenning, dus het is een beredeneerde gok en geen transcriptie. Schone, rechte, goed belichte letters op een fatsoenlijke resolutie komen er bijna perfect uit; een schuin genomen foto, een vage fax, een ongebruikelijk lettertype of handschrift levert fouten op. Lees het resultaat altijd naast het origineel voordat je erop vertrouwt. De taalinstelling doet ertoe: met de verkeerde krijg je zelfverzekerde onzin terug in plaats van een foutmelding.
Voor de omzetting niet: die gebeurt in de browser die je al open hebt staan. Om het resultaat te openen heb je daarna het programma nodig waarmee je apparaat Plain Text normaal weergeeft.
Wat deze pagina over TIFF en TXT beweert, is na te gaan, en dit zijn de documenten die de zaak beslechten.