Cookies para estatística e publicidade
Usamos cookies de estatística e de publicidade, ambos enviados ao Google. Recusar não muda nada do que você vê.Ler a página de privacidade
Aqui você converte WebP para TXT de graça e sem conta: solte o arquivo acima e em poucos segundos o resultado está pronto para baixar. A conversão acontece dentro do seu próprio navegador, então o arquivo nunca é enviado. Funciona igual no Windows, no macOS e no Linux e também no iPhone e no Android, e continua funcionando mesmo se você cortar a conexão.
Até 100 arquivos de uma vez. Formatos misturados não são problema.
Eles são convertidos um após o outro e baixados juntos em um ZIP.
WebP para TXT
Ninguém exporta WebP de uma câmera ou de um scanner. É um formato de entrega para página web, e praticamente todo WebP que alguém tem chegou salvando uma imagem de um site — motivo pelo qual esta conversão tem um público bem mais específico que as outras páginas de reconhecimento deste site.
O que as pessoas salvam costuma ser informação publicada como imagem: um gráfico, uma tabela de preço, uma comparação, uma citação, uma captura de tela que alguém postou, um documento que foi digitalizado e colocado numa página como imagem. Em todo caso, as palavras estão visíveis e não são selecionáveis, e ler de volta é o único caminho fora de digitar tudo de novo.
Imagens de web são servidas no tamanho que a página precisava. Um gráfico exibido a 600 pixels de largura é guardado mais ou menos nesse tamanho, muitas vezes menos numa página otimizada para velocidade — e reconhecimento de texto precisa de pixel suficiente por caractere para funcionar.
Então o resultado em imagem de web varia muito mais que em digitalização ou foto de celular, e a causa é quase sempre a mesma. Ampliar o arquivo depois não ajuda; acrescenta pixel sem acrescentar informação e geralmente amolece a letra, piorando a leitura em vez de melhorar.
Esta é a coisa mais útil desta página. Muitos sites servem várias versões da mesma imagem e exibem a menor que couber — abrir a imagem numa aba própria, ou olhar o código-fonte da página em busca de uma origem maior no conjunto, costuma achar uma versão duas ou três vezes o tamanho.
Duas ou três vezes mais pixel é a diferença entre uma leitura bagunçada e uma limpa. Leva trinta segundos e vence qualquer ajuste desta página somados.
O resultado é texto puro na ordem de leitura. Para um gráfico, isso significa que você recebe os rótulos dos eixos, os nomes das séries e os números, sem indicação nenhuma de qual pertencia a qual — o arranjo que tornava aquilo um gráfico é espacial, e texto puro não tem espaço.
Ainda assim é útil quando o ponto é capturar os números. Não é útil para reconstruir o gráfico, e para uma tabela publicada como imagem, espere gastar tanto tempo remontando as colunas quanto lendo elas. Onde o dado original existe em algum lugar, achá-lo é mais rápido que reconhecer uma imagem dele.
Reconhecimento compara forma com letra sem entender nada, e não tem como sinalizar onde teve dúvida. O resultado é fluente e parece completo, esteja cada caractere certo ou não.
Isso importa em especial para o material salvo de página web: preço, estatística, data, porcentagem, referência. Um dígito lido errado num número que você depois cita é o erro mais provável de sobreviver a uma olhada rápida e menos provável de ser perdoado. Confira os números contra a imagem.
O reconhecedor trabalha dentro das letras e do vocabulário de um idioma, e, com o idioma errado, não reporta uma falha — devolve a correspondência mais próxima disponível num conjunto que não pode conter a resposta certa.
Isso aparece o tempo todo em imagem de web, porque uma página que você está lendo traduzida, ou uma captura de tela de outro país, não está no idioma padrão da sua máquina. Se um resultado parece estranho de um jeito que você não consegue explicar, isso é a primeira coisa a conferir.
O reconhecimento acontece dentro da aba do navegador, no seu próprio processador. A imagem nunca é enviada a lugar nenhum, não há conta e não há limite diário, e uma pasta de imagens salvas converte numa passagem só.
Também significa que a conversão funciona em material que você não gostaria de entregar a um terceiro — um painel interno que alguém capturou em tela, um documento compartilhado num grupo privado, uma página atrás de login. Esses são boa parte do que acaba sendo salvo como imagem e lido de volta.
| WebP | TXT | |
|---|---|---|
| Nome completo | Imagem WebP | Texto simples |
| Extensão do arquivo | .webp | .txt, .text, .log |
| Tipo de mídia | image/webp | text/plain |
| Compressão | Um ou outro, conforme a configuração | — |
| Publicado pela primeira vez | 2010 | 1963 |
| Publicado por | — | |
| Especificação | RFC 9649 | Unicode |
| Licença | Padrão aberto | Padrão aberto |
| Situação hoje | Atual | Atual |
| Profundidade de bits | 8 | — |
| Cor que consegue descrever | RGB, YCbCr | — |
| Maior imagem | 16.383 px por lado | — |
| Abre no navegador | Todos os navegadores | Todos os navegadores |
| Considerado no lugar | AVIF, JPG, PNG | MD, RTF |
TXT é formato de trabalho e WebP é formato pronto. Volta texto editável em vez de uma imagem da página, o que costuma ser o motivo da conversão e também o seu limite.
Os programas de sempre não se cruzam: WebP abre em Adobe Photoshop, GIMP e Squoosh, e TXT em Notepad, TextEdit e Visual Studio Code, então quem receber o resultado precisa de algum do segundo grupo.
Os dois miram trabalhos diferentes: WebP em a web e entregar um arquivo pronto, TXT em mover dados entre programas e o arquivamento. Vale pesar isso antes, porque o motivo de um existir costuma ser o motivo de o outro ser incômodo.
WebP é o formato da Google, publicado em 2010. Registra 8 bits por canal.
TXT e de 1963, descrito em Unicode. Notepad, TextEdit e Visual Studio Code leem o formato.
TXT foi publicado em 1963 e WebP em 2010. O mais antigo costuma ser o arquivo mais seguro para entregar; o mais novo faz o mesmo com menos bytes.
Não. Esta conversão acontece inteiramente no seu navegador, então o arquivo não sai do seu aparelho. Você mesmo pode conferir: abra a aba de rede das ferramentas de desenvolvedor e converta alguma coisa. Você verá a própria página e as requisições de estatística e de publicidade com que este serviço é pago, e nenhuma que leve o seu arquivo. O motor deste par específico é Tesseract, o motor livre de reconhecimento de texto; seu navegador baixa isso uma vez e guarda.
É. Sem conta, sem marca d’água e sem cota diária para gastar: roda no seu próprio aparelho, então você pode voltar quantas vezes quiser. O navegador processa arquivos de até 100 MB, 100 por vez. Tesseract é baixado para a sua máquina e roda lá, e por isso não há contador.
WebP e TXT descrevem o conteúdo de maneiras radicalmente diferentes. A conversão é, portanto, uma reconstrução e não uma cópia: fiel, mas não idêntica byte a byte. O texto é lido por reconhecimento de padrões, então é um palpite fundamentado e não uma transcrição. Tipografia limpa, reta e bem iluminada numa resolução decente sai quase perfeita; uma foto tirada de lado, um fax apagado, uma fonte incomum ou letra à mão vão gerar erros. Confira sempre o resultado contra o original antes de confiar nele. O ajuste de idioma importa: com o errado, o que volta é bobagem com ar de certeza, e não uma mensagem de erro.
TXT é formato de trabalho e WebP é formato pronto. Volta texto editável em vez de uma imagem da página, o que costuma ser o motivo da conversão e também o seu limite.
O que esta página afirma sobre WebP e TXT pode ser conferido, e estes são os documentos que resolvem a questão.