Cookies para estatística e publicidade
Usamos cookies de estatística e de publicidade, ambos enviados ao Google. Recusar não muda nada do que você vê.Ler a página de privacidade
Aqui você converte JXL para TXT de graça e sem conta: solte o arquivo acima e em poucos segundos o resultado está pronto para baixar. A conversão acontece dentro do seu próprio navegador, então o arquivo nunca é enviado. Funciona igual no Windows, no macOS e no Linux e também no iPhone e no Android, e continua funcionando mesmo se você cortar a conexão.
Até 100 arquivos de uma vez. Formatos misturados não são problema.
Eles são convertidos um após o outro e baixados juntos em um ZIP.
JXL para TXT
Toda outra conversão deste site pega um arquivo e escreve o mesmo arquivo em outra forma. Esta faz algo categoricamente diferente: olha para uma imagem e escreve o que acha que a imagem diz. Não existe mapeamento de um JPEG XL para um arquivo de texto.
É por isso que a saída é rotulada como um palpite e não como um resultado. Um conversor funciona ou dá erro; um reconhecedor devolve texto que parece texto, tenha acertado ou não a página. Ler o resultado contra o original antes de confiar nele é o hábito mais útil aqui.
JPEG XL perdeu a disputa dos navegadores, mas não perdeu em todo lugar, e os lugares onde sobreviveu são exatamente onde documentos vivem. O registro deste site lista arquivamento e fotografia como seus usos, e arquivamento é o honesto: projetos de digitalização escolheram o formato porque ele comprime sem perdas bem e guarda mais bits por canal.
A outra rota comum é a Apple. Safari suporta JPEG XL desde a versão 17, então um arquivo salvo da web num Mac ou iPhone pode chegar como .jxl sem que ninguém tenha escolhido isso.
Todo outro caminho de imagem deste site decodifica o arquivo para pixels primeiro. Este não: o arquivo vai para o motor de reconhecimento como está, porque esse motor tem seu próprio carregador e forçar a imagem por um canvas achataria transparência em preto.
A consequência é que seu navegador não faz parte disso. Os únicos decodificadores capazes de agir sobre o arquivo são os seis compilados no núcleo de reconhecimento: BMP, JPEG, PNG, PBM, WebP e GIF não animado. JPEG XL não está entre eles.
Esta página costumava dizer que ler um JXL dependia do navegador, e citava o Safari como onde funcionava. Isso estava errado: o Safari exibe JPEG XL desde a versão 17, mas o reconhecedor nunca pede ao navegador para exibir nada, então o Safari falha aqui exatamente como o Chrome.
O que funciona é uma conversão extra. Converta o JXL para PNG neste site, depois leia o texto do PNG. Esse primeiro passo carrega seu próprio decodificador JPEG XL compilado em WebAssembly, rodando igual em qualquer navegador. PNG é o formato certo para o arquivo intermediário porque é sem perdas.
Inglês, alemão, francês e espanhol têm modelos disponíveis, e a configuração não é opcional na prática. O reconhecedor compara formas contra as letras e o vocabulário de um idioma por vez, então uma página em português lida como inglês não produz erro — produz lixo de aparência fluente.
Importa mais para caracteres acentuados e para conteúdo misto. Um documento em espanhol com termos técnicos em inglês lê melhor com espanhol selecionado do que com qualquer um dos dois adivinhado.
Reconhecimento precisa de pixels suficientes por caractere, e essa é a variável que separa um resultado quase perfeito de um inútil. Uma página escaneada a 300 dpi tem de sobra. Uma foto de uma página tirada do outro lado da mesa pode não ter.
Ampliar a imagem depois não ajuda — adiciona pixels sem adicionar informação e costuma piorar o resultado ao suavizar as formas das letras. Se um resultado voltar ruim, o conserto é a montante: escaneie de novo numa resolução maior.
Um arquivo de texto não tem colunas, células, fonte nem posição. O que você recebe são os caracteres que o reconhecedor encontrou, na ordem em que leu, e isso é uma perda genuína de estrutura em vez de uma preferência de formatação.
As quebras de linha ficam exatamente como foram vistas, sem tentativa de juntar linhas quebradas ou colapsar linhas em branco. Isso parece bagunçado e é deliberado: um poema, um endereço e uma tabela perdem sentido de formas diferentes quando as quebras são arrumadas.
A falha característica não é uma bagunça óbvia, que você notaria. É uma substituição plausível num número ou num nome — um 5 lido como S, um 1 como L minúsculo — dentro de um parágrafo por outro lado perfeito. Números de referência, dados de conta e preços são onde isso causa dano real.
A regra prática é revisar qualquer coisa que será usada em vez de só lida. Passar o olho num parágrafo recuperado capta as falhas óbvias; conferir um código de barras caractere por caractere é o único jeito de pegar a perigosa.
Reconhecimento de texto é de longe o motor mais lento deste site. A primeira conversão também precisa buscar o núcleo WebAssembly e o modelo de idioma antes de começar, então a primeira rodada custa mais que as seguintes — o modelo fica carregado pelo resto da sessão.
A barra de progresso rastreia deliberadamente só o reconhecimento em si, em vez do download e da inicialização. Uma página leva segundos; uma pasta delas leva segundos cada, em sequência, no seu processador.
O motor de reconhecimento, seu núcleo WebAssembly e todos os quatro modelos de idioma são servidos pela origem deste site. Isso foi trabalho deliberado: a biblioteca buscaria os três de um CDN público por padrão, o que enviaria seu endereço a terceiros.
A imagem em si nunca seria enviada de qualquer forma — mas alguém lendo um contracheque não devia ter esse fato anunciado a uma rede de conteúdo. Um teste no repositório falha se uma URL de CDN reaparecer algum dia.
| JXL | TXT | |
|---|---|---|
| Nome completo | JPEG XL | Texto simples |
| Extensão do arquivo | .jxl | .txt, .text, .log |
| Tipo de mídia | image/jxl | text/plain |
| Compressão | Um ou outro, conforme a configuração | — |
| Publicado pela primeira vez | 2021 | 1963 |
| Publicado por | Joint Photographic Experts Group | — |
| Especificação | ISO/IEC 18181 | Unicode |
| Licença | Padrão aberto | Padrão aberto |
| Situação hoje | De nicho | Atual |
| Profundidade de bits | 32 | — |
| Cor que consegue descrever | RGB, tons de cinza, gama ampla | — |
| Abre no navegador | Alguns navegadores | Todos os navegadores |
| Considerado no lugar | AVIF, WebP, PNG | MD, RTF |
TXT é formato de trabalho e JXL é formato pronto. Volta texto editável em vez de uma imagem da página, o que costuma ser o motivo da conversão e também o seu limite.
TXT abre em qualquer navegador atual. JXL alcança ainda menos navegadores. Se o arquivo vai para uma página web ou um formulário, esse costuma ser todo o motivo da conversão.
Os programas de sempre não se cruzam: JXL abre em GIMP e ImageMagick, e TXT em Notepad, TextEdit e Visual Studio Code, então quem receber o resultado precisa de algum do segundo grupo.
JXL é o formato da Joint Photographic Experts Group, publicado em 2021. Registra 32 bits por canal.
TXT e de 1963, descrito em Unicode. Notepad, TextEdit e Visual Studio Code leem o formato.
TXT foi publicado em 1963 e JXL em 2021. O mais antigo costuma ser o arquivo mais seguro para entregar; o mais novo faz o mesmo com menos bytes.
Não. Esta conversão acontece inteiramente no seu navegador, então o arquivo não sai do seu aparelho. Você mesmo pode conferir: abra a aba de rede das ferramentas de desenvolvedor e converta alguma coisa. Você verá a própria página e as requisições de estatística e de publicidade com que este serviço é pago, e nenhuma que leve o seu arquivo. O motor deste par específico é Tesseract, o motor livre de reconhecimento de texto; seu navegador baixa isso uma vez e guarda.
É. Sem conta, sem marca d’água e sem cota diária para gastar: roda no seu próprio aparelho, então você pode voltar quantas vezes quiser. O navegador processa arquivos de até 100 MB, 100 por vez. Tesseract é baixado para a sua máquina e roda lá, e por isso não há contador.
JXL e TXT descrevem o conteúdo de maneiras radicalmente diferentes. A conversão é, portanto, uma reconstrução e não uma cópia: fiel, mas não idêntica byte a byte. O texto é lido por reconhecimento de padrões, então é um palpite fundamentado e não uma transcrição. Tipografia limpa, reta e bem iluminada numa resolução decente sai quase perfeita; uma foto tirada de lado, um fax apagado, uma fonte incomum ou letra à mão vão gerar erros. Confira sempre o resultado contra o original antes de confiar nele. O ajuste de idioma importa: com o errado, o que volta é bobagem com ar de certeza, e não uma mensagem de erro.
TXT é formato de trabalho e JXL é formato pronto. Volta texto editável em vez de uma imagem da página, o que costuma ser o motivo da conversão e também o seu limite.