Sobre a ferramenta: Imagem para texto (OCR)
Este conversor de imagem para texto usa OCR (reconhecimento óptico de caracteres) para ler o texto impresso de uma imagem e transformá-lo em texto simples. Em vez de redigitar um documento em papel ou uma frase de um print, basta soltar a imagem e copiar o resultado.
Ele roda o motor de OCR de código aberto Tesseract dentro do seu navegador, então suas imagens nunca são enviadas para um servidor. Só na primeira vez são baixados o motor e os dados de idioma (de 1 a 3 MB por idioma); depois eles são carregados do armazenamento do navegador.
Como usar
- Clique em Escolher imagem para selecionar uma foto ou digitalização, ou cole um print com Ctrl+V.
- Escolha o idioma ou os idiomas do texto. Selecionar só os que realmente aparecem deixa o reconhecimento mais rápido e preciso.
- Quando a barra de progresso chegar a 100%, o texto aparece na caixa abaixo. Você pode corrigir os erros ali mesmo.
- Clique em Copiar texto ou Salvar .txt para levar o resultado.
Dicas para um reconhecimento melhor
- Fotografe a página de frente e bem iluminada. Fotos tortas ou com sombra perdem muita precisão.
- Texto com letras maiúsculas de 20 pixels ou mais é bem lido. Para letras miúdas, aproxime e capture só aquele trecho (imagens pequenas são ampliadas automaticamente).
- Deixe Escala de cinza e mais contraste ativado para fundos coloridos e fotos desfocadas.
- Escolha só os idiomas do documento – idiomas a mais podem transformar letras em caracteres parecidos de outra escrita.
- Tabelas, letra cursiva, texto vertical e fontes decorativas têm precisão menor.
Tamanho do download por idioma
| Idioma | Download |
|---|---|
| Motor de OCR (comum, uma vez só) | cerca de 1,4 MB |
| Português | cerca de 1,4 MB |
| Inglês | cerca de 3,0 MB |
| Espanhol | cerca de 2,1 MB |
| Japonês | cerca de 2,0 MB |
| Chinês (tradicional) | cerca de 1,7 MB |
| Alemão, francês, italiano, coreano | 0,7–1,7 MB cada |
Os dados baixados ficam no armazenamento do navegador, então na próxima vez o reconhecimento começa na hora. Se estiver usando dados móveis, prefira fazer o primeiro uso no Wi-Fi.
Perguntas frequentes
Minhas imagens são enviadas para um servidor?
Não. O reconhecimento de texto acontece inteiramente no seu navegador, no seu próprio dispositivo. Só o motor de OCR e os dados de idioma são baixados – suas imagens e o texto extraído não são enviados para lugar nenhum.
Ele reconhece letra de mão?
Letra de forma bem caprichada às vezes funciona, mas o motor foi treinado com texto impresso, então a precisão com letra de mão é baixa.
Dá para extrair texto de um PDF?
Só arquivos de imagem são aceitos. Para um PDF digitalizado, converta primeiro as páginas em JPG com PDF para imagem. Se o PDF tiver texto selecionável, copiar direto no leitor de PDF é mais preciso.
Por que a primeira vez demora mais?
Na primeira vez é preciso baixar o motor de OCR e os dados de idioma. Depois disso, a cópia salva é usada e o reconhecimento costuma terminar em poucos segundos; fotos muito grandes demoram mais.
Ele reconhece acentos e cedilha?
Sim, desde que o português esteja selecionado. Só com inglês, letras como ã, é e ç costumam ser lidas sem acento – escolha sempre o idioma do texto.