JPG naar TXT omzetten

Hier zet je JPG naar TXT om, gratis en zonder account: sleep het bestand hierboven erin en binnen een paar seconden staat het resultaat klaar om te downloaden. De omzetting gebeurt binnen je eigen browser, dus het bestand wordt nooit geüpload. Het werkt hetzelfde op Windows, macOS en Linux als op iPhone en Android, en het blijft werken als je de verbinding verbreekt.

  • Waar het draait In je browser. Het bestand wordt nooit geüpload.
  • Opnieuw opgebouwd TXT werkt anders dan JPG. Het is dus niet het geleidelijke kwaliteitsverlies van een lossy codec: wat TXT kan uitdrukken wordt getrouw weergegeven, en wat daar geen equivalent heeft blijft helemaal weg.
  • Maximale grootte Tot 100 MB per bestand, gratis en zonder account.
  • Goed om te weten De tekst wordt gelezen door patroonherkenning, dus het is een beredeneerde gok en geen transcriptie. Schone, rechte, goed belichte letters op een fatsoenlijke resolutie komen er bijna perfect uit; een schuin genomen foto, een vage fax, een ongebruikelijk lettertype of handschrift levert fouten op. Lees het resultaat altijd naast het origineel voordat je erop vertrouwt. De taalinstelling doet ertoe: met de verkeerde krijg je zelfverzekerde onzin terug in plaats van een foutmelding.

Tot 100 bestanden tegelijk. Verschillende formaten door elkaar is prima.

Dit is een gok, en zo moet je het ook lezen

Tekstherkenning kijkt naar vormen en beslist welke letters het zijn. Het weet niet wat er werkelijk staat, en het kan nergens aangeven hoe zeker het was — het resultaat oogt vloeiend en compleet, ook als er ergens een fout in zit die niemand heeft gezien.

Lees de uitkomst dus altijd tegen het origineel aan, vooral de cijfers. Een verkeerd gelezen cijfer in een bedrag, een rekeningnummer of een datum is precies het soort fout dat een vluchtige blik overleeft en pas later problemen geeft.

De foto bepaalt de nauwkeurigheid, niet de instellingen

Recht, goed belicht en scherp gedrukte tekst op een redelijk formaat komt er bijna foutloos uit. Alles wat de foto verslechtert, verslechtert ook de herkenning: onscherpte eerst, dan schaduw over de tekst, dan een schuine hoek, dan tekst die te klein in beeld staat.

De camera is dus de knop die er echt toe doet. Leg het blad plat neer, fotografeer recht van boven, zorg voor licht van de zijkant in plaats van van achteren, vul het beeld met de pagina en tik om scherp te stellen voordat je afdrukt. Tien seconden daaraan besteden levert meer op dan welke nabewerking dan ook.

Zet eerst de taal, dan pas converteren

Dit is de instelling die ertoe doet en die mensen overslaan. De herkenning vergelijkt vormen met de letters en het vocabulaire van een bepaalde taal, en bij de verkeerde keuze faalt het niet — het produceert overtuigende onzin, omdat het de beste match zoekt binnen een set die het juiste antwoord niet bevat.

Een Duitse pagina gelezen als Engels komt terug met verminkte umlauten en woorden die bijna bestaan. Als een resultaat er vreemd uitziet op een manier die je niet kunt verklaren, controleer dan eerst dit.

Je krijgt woorden, geen document

De uitvoer is platte tekst: geen koppen, geen kolommen, geen tabellen, geen posities. Een brief met één kolom komt leesbaar en in de juiste volgorde terug. Een pagina met twee kolommen kan door elkaar komen te staan, omdat de herkenning regels leest die er als regels uitzien.

Een formulier is het lastigste geval — labels en waarden komen naast elkaar te staan op een manier die moeilijk te ontwarren is, en een tabel wordt een reeks losse cijfers zonder kolomindeling. Reken erop dat je daar zelf nog werk aan hebt, of fotografeer één veld tegelijk.

Handschrift is een ander probleem

Deze herkenning is gebouwd voor gedrukte letters, waarbij een letter een van de paar duizend mogelijke vormen is. Handschrift is dat niet: elke schrijver maakt andere vormen, en dezelfde schrijver maakt op verschillende dagen weer andere vormen.

Nette, losse blokletters komen er soms bruikbaar uit. Gewoon lopend schrift meestal niet, en de uitvoer ziet er dan uit als echte woorden in plaats van als een fout — wat erger is dan mislukken, omdat het uitnodigt tot geloven. Een handgeschreven briefje overtypen is vaak sneller dan een herkenning ervan corrigeren.

Wat mensen daadwerkelijk fotograferen

Bonnetjes voor de administratie. Brieven en formulieren die op papier zijn binnengekomen. Bladzijden uit boeken voor een bronvermelding. Whiteboards na een vergadering. Serienummers op apparatuur. Menu’s en borden onderweg.

Bijna al deze foto’s zijn persoonlijk of zakelijk: namen, adressen, bedragen, rekeninggegevens, medische informatie. Dat is precies de context waarin de volgende paragraaf ertoe doet.

Er wordt niets ergens naartoe gestuurd

De herkenning draait in het browsertabblad, op je eigen apparaat. De foto wordt nooit geüpload, dus er is geen kopie op een server, geen bewaartermijn om naar te vragen, geen account en geen daglimiet.

Het netwerktabblad in de ontwikkelaarstools bevestigt dit tijdens de omzetting: er gaat geen verzoek uit dat de afbeelding meeneemt. Bij een foto van een recept, een bankbrief of een getekend contract is dat geen bijkomstigheid maar het belangrijkste verschil met een online dienst.

Andere brontypen dan JPG geven een ander resultaat

Deze herkenning werkt ook op PNG, WebP, AVIF, JXL, GIF, BMP, TIFF, HEIC en HEIF, maar een gefotografeerd document is een andere opgave dan een schermafbeelding. Een schermafbeelding heeft scherpe, rechte tekst zonder perspectief; een foto heeft vrijwel altijd een lichte hoek, een beetje beweging en variërend licht.

Twijfel je tussen een foto en een schermafbeelding van hetzelfde document, kies dan de schermafbeelding als die beschikbaar is — de herkenning heeft daar aanzienlijk minder aan te corrigeren.

Zo zet je JPG naar TXT om

  1. Sleep je JPG-bestand op deze pagina, of klik om er een te kiezen.
  2. Kies TXT als doel. De omzetting gebeurt in je browser en het bestand wordt niet geüpload.
  3. Download het klare TXT-bestand.

JPG of TXT: wat er verandert

JPG vergeleken met TXT
JPGTXT
Volledige naamJPEG-afbeeldingPlatte tekst
Bestandsextensie.jpg, .jpeg, .jpe.txt, .text, .log
Mediatypeimage/jpegtext/plain
CompressieMet verlies — grootte wordt met kwaliteit betaald
Voor het eerst gepubliceerd19921963
Uitgegeven doorJoint Photographic Experts Group
SpecificatieITU-T T.81Unicode
LicentieOpen standaardOpen standaard
Stand van zakenActueelActueel
Bitdiepte8
Kleur die het kan beschrijvenRGB, grijswaarden, YCbCr
Grootste afbeelding65.535 px per zijde
Opent in een browserElke browserElke browser
In plaats daarvan overwogenWebP, AVIF, HEICMD, RTF

Wat het doelformaat erbij kan

TXT is een werkformaat en JPG een af formaat. Wat terugkomt is bewerkbare tekst in plaats van een afbeelding van de pagina, meestal de reden voor de omzetting en tegelijk haar grens.

Het resultaat openen

De gebruikelijke programma's overlappen niet: JPG open je in Adobe Photoshop, GIMP en Preview, TXT in Notepad, TextEdit en Visual Studio Code — wie het resultaat krijgt, heeft dus iets uit de tweede rij nodig.

Bestandsgrootte en kwaliteit

Het resultaat wordt groter dan het origineel en niet beter. JPG heeft al detail weggegooid en TXT bewaart wat er over is zonder er meer weg te gooien: het voorkomt verder verlies, het draait het eerste niet terug.

Waarvoor elk formaat bedoeld is

De twee mikken op ander werk: JPG op fotografie, het web, e-mail en een af bestand overdragen, TXT op gegevens tussen programma’s verplaatsen en archivering. Dat is het afwegen waard, want de reden dat het ene bestaat is meestal de reden dat het andere onhandig is.

JPG is het formaat van Joint Photographic Experts Group, verschenen in 1992. Er wordt met 8 bits per kanaal vastgelegd.

TXT stamt uit 1963, vastgelegd in Unicode. Notepad, TextEdit en Visual Studio Code lezen het formaat.

TXT verscheen in 1963 en JPG in 1992. Het oudste is doorgaans het veiligste bestand om te overhandigen; het nieuwste doet hetzelfde werk met minder bytes.

Van JPG naar TXT: veelgestelde vragen

Wordt mijn JPG-bestand ergens heen geüpload?

Nee. Deze omzetting gebeurt volledig in je browser, dus het bestand verlaat je apparaat niet. Je kunt het zelf nagaan: open het netwerktabblad van de ontwikkelaarshulpmiddelen en zet iets om. Je ziet de pagina zelf en de verzoeken voor statistiek en advertenties waarmee deze dienst betaald wordt, en geen enkel verzoek dat je bestand meeneemt. De motor achter juist dit paar is Tesseract, de opensource-tekstherkenning; je browser haalt die één keer op en bewaart hem.

Is JPG naar TXT omzetten gratis?

Ja. Geen account, geen watermerk en geen dagtegoed dat opraakt: het draait op je eigen machine, dus je mag zo vaak terugkomen als je wilt. De browser verwerkt bestanden tot 100 MB, 100 tegelijk. Tesseract wordt naar je eigen machine gehaald en draait daar, en daarom staat er geen teller op.

Gaat er kwaliteit verloren bij het omzetten van JPG naar TXT?

JPG en TXT beschrijven de inhoud op fundamenteel andere manieren. De omzetting is daarom een reconstructie en geen kopie: getrouw, maar niet byte voor byte identiek. De tekst wordt gelezen door patroonherkenning, dus het is een beredeneerde gok en geen transcriptie. Schone, rechte, goed belichte letters op een fatsoenlijke resolutie komen er bijna perfect uit; een schuin genomen foto, een vage fax, een ongebruikelijk lettertype of handschrift levert fouten op. Lees het resultaat altijd naast het origineel voordat je erop vertrouwt. De taalinstelling doet ertoe: met de verkeerde krijg je zelfverzekerde onzin terug in plaats van een foutmelding.

Wordt de kwaliteit beter door omzetten naar TXT?

Het resultaat wordt groter dan het origineel en niet beter. JPG heeft al detail weggegooid en TXT bewaart wat er over is zonder er meer weg te gooien: het voorkomt verder verlies, het draait het eerste niet terug.

Is het TXT-bestand daarna bewerkbaar?

TXT is een werkformaat en JPG een af formaat. Wat terugkomt is bewerkbare tekst in plaats van een afbeelding van de pagina, meestal de reden voor de omzetting en tegelijk haar grens.

Meer over deze formaten

Waar deze cijfers vandaan komen

Wat deze pagina over JPG en TXT beweert, is na te gaan, en dit zijn de documenten die de zaak beslechten.