Cookies voor statistiek en advertenties
We gebruiken cookies voor statistiek en voor advertenties, allebei naar Google. Weigeren verandert niets aan wat je te zien krijgt.Lees de privacypagina
Hier zet je JPG naar TXT om, gratis en zonder account: sleep het bestand hierboven erin en binnen een paar seconden staat het resultaat klaar om te downloaden. De omzetting gebeurt binnen je eigen browser, dus het bestand wordt nooit geüpload. Het werkt hetzelfde op Windows, macOS en Linux als op iPhone en Android, en het blijft werken als je de verbinding verbreekt.
Tot 100 bestanden tegelijk. Verschillende formaten door elkaar is prima.
Ze worden een voor een omgezet en samen in één ZIP gedownload.
JPG naar TXT
Tekstherkenning kijkt naar vormen en beslist welke letters het zijn. Het weet niet wat er werkelijk staat, en het kan nergens aangeven hoe zeker het was — het resultaat oogt vloeiend en compleet, ook als er ergens een fout in zit die niemand heeft gezien.
Lees de uitkomst dus altijd tegen het origineel aan, vooral de cijfers. Een verkeerd gelezen cijfer in een bedrag, een rekeningnummer of een datum is precies het soort fout dat een vluchtige blik overleeft en pas later problemen geeft.
Recht, goed belicht en scherp gedrukte tekst op een redelijk formaat komt er bijna foutloos uit. Alles wat de foto verslechtert, verslechtert ook de herkenning: onscherpte eerst, dan schaduw over de tekst, dan een schuine hoek, dan tekst die te klein in beeld staat.
De camera is dus de knop die er echt toe doet. Leg het blad plat neer, fotografeer recht van boven, zorg voor licht van de zijkant in plaats van van achteren, vul het beeld met de pagina en tik om scherp te stellen voordat je afdrukt. Tien seconden daaraan besteden levert meer op dan welke nabewerking dan ook.
Dit is de instelling die ertoe doet en die mensen overslaan. De herkenning vergelijkt vormen met de letters en het vocabulaire van een bepaalde taal, en bij de verkeerde keuze faalt het niet — het produceert overtuigende onzin, omdat het de beste match zoekt binnen een set die het juiste antwoord niet bevat.
Een Duitse pagina gelezen als Engels komt terug met verminkte umlauten en woorden die bijna bestaan. Als een resultaat er vreemd uitziet op een manier die je niet kunt verklaren, controleer dan eerst dit.
De uitvoer is platte tekst: geen koppen, geen kolommen, geen tabellen, geen posities. Een brief met één kolom komt leesbaar en in de juiste volgorde terug. Een pagina met twee kolommen kan door elkaar komen te staan, omdat de herkenning regels leest die er als regels uitzien.
Een formulier is het lastigste geval — labels en waarden komen naast elkaar te staan op een manier die moeilijk te ontwarren is, en een tabel wordt een reeks losse cijfers zonder kolomindeling. Reken erop dat je daar zelf nog werk aan hebt, of fotografeer één veld tegelijk.
Deze herkenning is gebouwd voor gedrukte letters, waarbij een letter een van de paar duizend mogelijke vormen is. Handschrift is dat niet: elke schrijver maakt andere vormen, en dezelfde schrijver maakt op verschillende dagen weer andere vormen.
Nette, losse blokletters komen er soms bruikbaar uit. Gewoon lopend schrift meestal niet, en de uitvoer ziet er dan uit als echte woorden in plaats van als een fout — wat erger is dan mislukken, omdat het uitnodigt tot geloven. Een handgeschreven briefje overtypen is vaak sneller dan een herkenning ervan corrigeren.
Bonnetjes voor de administratie. Brieven en formulieren die op papier zijn binnengekomen. Bladzijden uit boeken voor een bronvermelding. Whiteboards na een vergadering. Serienummers op apparatuur. Menu’s en borden onderweg.
Bijna al deze foto’s zijn persoonlijk of zakelijk: namen, adressen, bedragen, rekeninggegevens, medische informatie. Dat is precies de context waarin de volgende paragraaf ertoe doet.
De herkenning draait in het browsertabblad, op je eigen apparaat. De foto wordt nooit geüpload, dus er is geen kopie op een server, geen bewaartermijn om naar te vragen, geen account en geen daglimiet.
Het netwerktabblad in de ontwikkelaarstools bevestigt dit tijdens de omzetting: er gaat geen verzoek uit dat de afbeelding meeneemt. Bij een foto van een recept, een bankbrief of een getekend contract is dat geen bijkomstigheid maar het belangrijkste verschil met een online dienst.
Deze herkenning werkt ook op PNG, WebP, AVIF, JXL, GIF, BMP, TIFF, HEIC en HEIF, maar een gefotografeerd document is een andere opgave dan een schermafbeelding. Een schermafbeelding heeft scherpe, rechte tekst zonder perspectief; een foto heeft vrijwel altijd een lichte hoek, een beetje beweging en variërend licht.
Twijfel je tussen een foto en een schermafbeelding van hetzelfde document, kies dan de schermafbeelding als die beschikbaar is — de herkenning heeft daar aanzienlijk minder aan te corrigeren.
| JPG | TXT | |
|---|---|---|
| Volledige naam | JPEG-afbeelding | Platte tekst |
| Bestandsextensie | .jpg, .jpeg, .jpe | .txt, .text, .log |
| Mediatype | image/jpeg | text/plain |
| Compressie | Met verlies — grootte wordt met kwaliteit betaald | — |
| Voor het eerst gepubliceerd | 1992 | 1963 |
| Uitgegeven door | Joint Photographic Experts Group | — |
| Specificatie | ITU-T T.81 | Unicode |
| Licentie | Open standaard | Open standaard |
| Stand van zaken | Actueel | Actueel |
| Bitdiepte | 8 | — |
| Kleur die het kan beschrijven | RGB, grijswaarden, YCbCr | — |
| Grootste afbeelding | 65.535 px per zijde | — |
| Opent in een browser | Elke browser | Elke browser |
| In plaats daarvan overwogen | WebP, AVIF, HEIC | MD, RTF |
TXT is een werkformaat en JPG een af formaat. Wat terugkomt is bewerkbare tekst in plaats van een afbeelding van de pagina, meestal de reden voor de omzetting en tegelijk haar grens.
De gebruikelijke programma's overlappen niet: JPG open je in Adobe Photoshop, GIMP en Preview, TXT in Notepad, TextEdit en Visual Studio Code — wie het resultaat krijgt, heeft dus iets uit de tweede rij nodig.
Het resultaat wordt groter dan het origineel en niet beter. JPG heeft al detail weggegooid en TXT bewaart wat er over is zonder er meer weg te gooien: het voorkomt verder verlies, het draait het eerste niet terug.
De twee mikken op ander werk: JPG op fotografie, het web, e-mail en een af bestand overdragen, TXT op gegevens tussen programma’s verplaatsen en archivering. Dat is het afwegen waard, want de reden dat het ene bestaat is meestal de reden dat het andere onhandig is.
JPG is het formaat van Joint Photographic Experts Group, verschenen in 1992. Er wordt met 8 bits per kanaal vastgelegd.
TXT stamt uit 1963, vastgelegd in Unicode. Notepad, TextEdit en Visual Studio Code lezen het formaat.
TXT verscheen in 1963 en JPG in 1992. Het oudste is doorgaans het veiligste bestand om te overhandigen; het nieuwste doet hetzelfde werk met minder bytes.
Nee. Deze omzetting gebeurt volledig in je browser, dus het bestand verlaat je apparaat niet. Je kunt het zelf nagaan: open het netwerktabblad van de ontwikkelaarshulpmiddelen en zet iets om. Je ziet de pagina zelf en de verzoeken voor statistiek en advertenties waarmee deze dienst betaald wordt, en geen enkel verzoek dat je bestand meeneemt. De motor achter juist dit paar is Tesseract, de opensource-tekstherkenning; je browser haalt die één keer op en bewaart hem.
Ja. Geen account, geen watermerk en geen dagtegoed dat opraakt: het draait op je eigen machine, dus je mag zo vaak terugkomen als je wilt. De browser verwerkt bestanden tot 100 MB, 100 tegelijk. Tesseract wordt naar je eigen machine gehaald en draait daar, en daarom staat er geen teller op.
JPG en TXT beschrijven de inhoud op fundamenteel andere manieren. De omzetting is daarom een reconstructie en geen kopie: getrouw, maar niet byte voor byte identiek. De tekst wordt gelezen door patroonherkenning, dus het is een beredeneerde gok en geen transcriptie. Schone, rechte, goed belichte letters op een fatsoenlijke resolutie komen er bijna perfect uit; een schuin genomen foto, een vage fax, een ongebruikelijk lettertype of handschrift levert fouten op. Lees het resultaat altijd naast het origineel voordat je erop vertrouwt. De taalinstelling doet ertoe: met de verkeerde krijg je zelfverzekerde onzin terug in plaats van een foutmelding.
Het resultaat wordt groter dan het origineel en niet beter. JPG heeft al detail weggegooid en TXT bewaart wat er over is zonder er meer weg te gooien: het voorkomt verder verlies, het draait het eerste niet terug.
TXT is een werkformaat en JPG een af formaat. Wat terugkomt is bewerkbare tekst in plaats van een afbeelding van de pagina, meestal de reden voor de omzetting en tegelijk haar grens.
Wat deze pagina over JPG en TXT beweert, is na te gaan, en dit zijn de documenten die de zaak beslechten.