Cookies para estatística e publicidade
Usamos cookies de estatística e de publicidade, ambos enviados ao Google. Recusar não muda nada do que você vê.Ler a página de privacidade
Aqui você converte JPG para TXT de graça e sem conta: solte o arquivo acima e em poucos segundos o resultado está pronto para baixar. A conversão acontece dentro do seu próprio navegador, então o arquivo nunca é enviado. Funciona igual no Windows, no macOS e no Linux e também no iPhone e no Android, e continua funcionando mesmo se você cortar a conexão.
Até 100 arquivos de uma vez. Formatos misturados não são problema.
Eles são convertidos um após o outro e baixados juntos em um ZIP.
JPG para TXT
Reconhecimento óptico de caracteres olha para formas e decide quais letras elas são. Ele não sabe o que o documento diz, e não tem como te dizer quão confiante estava — então a saída é um texto fluente e com aparência completa que pode conter erros que ninguém sinalizou.
Essa é a coisa mais importante de entender antes de confiar num resultado. Leia ele contra o original, sobretudo os números: um dígito lido errado num preço, num número de conta ou numa data é exatamente o erro que sobrevive a uma olhada rápida e causa um problema real depois.
Mais do que qualquer ajuste, mais do que qualquer ferramenta. Texto impresso, reto, bem iluminado, em foco e num tamanho razoável sai quase perfeito. Tudo que degrada a imagem degrada a leitura, mais ou menos na ordem que você esperaria: foco primeiro, depois sombra sobre o texto, depois o ângulo da página, depois o tamanho da letra no enquadramento.
O que significa que a alavanca útil é a câmera, não o conversor. Segure a página reta, fotografe de cima para baixo em vez de de uma cadeira, pegue luz de lado em vez de vinda de trás de você, encha o quadro com a página, e toque para focar antes de apertar o botão. Dez segundos disso valem mais do que qualquer quantidade de processamento depois.
Esse é o ajuste que importa e o que as pessoas pulam. O reconhecedor compara formas com as letras e o vocabulário de um idioma específico, e recebendo o errado ele não falha — produz um texto fluente e errado, porque está achando a melhor combinação dentro de um conjunto que não tem a resposta certa.
Uma página em alemão lida como inglês volta com trema desfigurado e palavras quase existentes. Um documento em idioma que não foi informado produz o mesmo efeito. Se um resultado parece estranho de um jeito que você não consegue explicar, confira isso antes de qualquer outra coisa.
A saída é texto puro: sem títulos, sem colunas, sem tabelas, sem posições. Uma carta de coluna única volta legível e em ordem. Uma página de duas colunas pode voltar com as colunas intercaladas, porque o reconhecedor lê ao longo de linhas que parecem linhas.
Um formulário é o caso mais difícil — rótulos e valores acabam próximos de um jeito difícil de reconstruir, e uma tabela vira uma sequência de números sem noção de qual coluna vieram. Para esses, o conselho honesto é esperar algum trabalho manual com o resultado, ou fotografar um campo por vez.
O reconhecimento aqui é construído para tipo impresso, onde uma letra é uma entre poucos milhares de possibilidades. Letra à mão não é assim: cada pessoa produz formas diferentes, e a mesma pessoa produz formas diferentes em dias diferentes.
Letra de forma limpa e separada às vezes sai utilizável. Letra cursiva comum geralmente não sai, e o resultado vai parecer palavras de verdade em vez de um erro — o que é pior do que falhar, porque convida a acreditar. Se um bilhete escrito à mão precisa virar texto, digitá-lo é mais rápido do que corrigir um reconhecimento dele.
Notas fiscais, para prestação de contas. Cartas e formulários que chegaram em papel. Páginas de livros e periódicos para uma citação. Quadros brancos depois de uma reunião. Números de série e etiquetas em equipamento. Cardápios, placas e avisos durante uma viagem.
Quase tudo isso é pessoal ou comercial: nomes, endereços, valores, dados de conta, informação médica. É nesse contexto que a próxima seção importa, e é por isso que ela está aqui na página, não num rodapé.
O reconhecimento roda dentro da aba do navegador, no seu próprio processador, no seu próprio dispositivo. A fotografia nunca é enviada, então não há cópia num servidor, nenhum prazo de retenção para perguntar, nenhuma conta e nenhuma cota diária.
Observar a aba de rede enquanto funciona é o jeito honesto de confirmar isso: nenhum pedido carregando a imagem sai. Para uma foto de uma receita médica, uma carta de banco ou um contrato assinado, essa é a diferença substancial em relação a um serviço hospedado, e não só uma frase de marketing.
Solte um lote inteiro de fotos e cada uma é reconhecida na sua vez, com os resultados voltando juntos e mantendo o nome de arquivo original. O motor é iniciado uma vez para o idioma escolhido e reaproveitado entre os arquivos, então dez fotos custam a inicialização de alguns segundos uma vez só.
Reconhecimento de texto é a operação mais lenta deste site, de longe, então um lote grande é algo para começar e voltar depois. Confira as primeiras páginas antes de deixar o resto rodando sozinho — um idioma errado descoberto na primeira foto custa segundos; descoberto na última custa o lote inteiro.
| JPG | TXT | |
|---|---|---|
| Nome completo | Imagem JPEG | Texto simples |
| Extensão do arquivo | .jpg, .jpeg, .jpe | .txt, .text, .log |
| Tipo de mídia | image/jpeg | text/plain |
| Compressão | Com perdas — o tamanho é comprado com qualidade | — |
| Publicado pela primeira vez | 1992 | 1963 |
| Publicado por | Joint Photographic Experts Group | — |
| Especificação | ITU-T T.81 | Unicode |
| Licença | Padrão aberto | Padrão aberto |
| Situação hoje | Atual | Atual |
| Profundidade de bits | 8 | — |
| Cor que consegue descrever | RGB, tons de cinza, YCbCr | — |
| Maior imagem | 65.535 px por lado | — |
| Abre no navegador | Todos os navegadores | Todos os navegadores |
| Considerado no lugar | WebP, AVIF, HEIC | MD, RTF |
TXT é formato de trabalho e JPG é formato pronto. Volta texto editável em vez de uma imagem da página, o que costuma ser o motivo da conversão e também o seu limite.
Os programas de sempre não se cruzam: JPG abre em Adobe Photoshop, GIMP e Preview, e TXT em Notepad, TextEdit e Visual Studio Code, então quem receber o resultado precisa de algum do segundo grupo.
O resultado fica maior que o original e não fica melhor. JPG já descartou detalhe e TXT guarda o que sobrou sem descartar mais: evita perda nova, não desfaz a primeira.
Os dois miram trabalhos diferentes: JPG em a fotografia, a web, e-mail e entregar um arquivo pronto, TXT em mover dados entre programas e o arquivamento. Vale pesar isso antes, porque o motivo de um existir costuma ser o motivo de o outro ser incômodo.
JPG é o formato da Joint Photographic Experts Group, publicado em 1992. Registra 8 bits por canal.
TXT e de 1963, descrito em Unicode. Notepad, TextEdit e Visual Studio Code leem o formato.
TXT foi publicado em 1963 e JPG em 1992. O mais antigo costuma ser o arquivo mais seguro para entregar; o mais novo faz o mesmo com menos bytes.
Não. Esta conversão acontece inteiramente no seu navegador, então o arquivo não sai do seu aparelho. Você mesmo pode conferir: abra a aba de rede das ferramentas de desenvolvedor e converta alguma coisa. Você verá a própria página e as requisições de estatística e de publicidade com que este serviço é pago, e nenhuma que leve o seu arquivo. O motor deste par específico é Tesseract, o motor livre de reconhecimento de texto; seu navegador baixa isso uma vez e guarda.
É. Sem conta, sem marca d’água e sem cota diária para gastar: roda no seu próprio aparelho, então você pode voltar quantas vezes quiser. O navegador processa arquivos de até 100 MB, 100 por vez. Tesseract é baixado para a sua máquina e roda lá, e por isso não há contador.
JPG e TXT descrevem o conteúdo de maneiras radicalmente diferentes. A conversão é, portanto, uma reconstrução e não uma cópia: fiel, mas não idêntica byte a byte. O texto é lido por reconhecimento de padrões, então é um palpite fundamentado e não uma transcrição. Tipografia limpa, reta e bem iluminada numa resolução decente sai quase perfeita; uma foto tirada de lado, um fax apagado, uma fonte incomum ou letra à mão vão gerar erros. Confira sempre o resultado contra o original antes de confiar nele. O ajuste de idioma importa: com o errado, o que volta é bobagem com ar de certeza, e não uma mensagem de erro.
O resultado fica maior que o original e não fica melhor. JPG já descartou detalhe e TXT guarda o que sobrou sem descartar mais: evita perda nova, não desfaz a primeira.
TXT é formato de trabalho e JPG é formato pronto. Volta texto editável em vez de uma imagem da página, o que costuma ser o motivo da conversão e também o seu limite.
O que esta página afirma sobre JPG e TXT pode ser conferido, e estes são os documentos que resolvem a questão.