Extrair texto de uma imagem (OCR)
Tire o texto da foto de um documento, de um print, de uma carta escaneada ou de um PDF escaneado inteiro em vez de digitar tudo de novo. O Tesseract, um motor de OCR de código aberto muito testado, lê direto no seu navegador em português, inglês, espanhol, francês e mais 12 idiomas. O resultado aparece num editor para você corrigir uma palavra antes de copiar.
Como funciona
- Arraste uma imagem ou PDF escaneado, ou cole um print com Ctrl+V.
- Escolha o idioma do texto.
- Confira o texto e copie ou baixe em .txt.
Perguntas frequentes
Qual a precisão?
Texto impresso em foto ou digitalização nítida e reta costuma sair quase sem erros. Letra de mão, texto muito pequeno, sombras fortes e fontes decorativas geram mais erros.
Lê PDF?
Sim. PDFs escaneados são lidos página por página. Se o PDF já tem texto de verdade, normalmente dá para selecionar e copiar no leitor de PDF.
Meu arquivo é enviado?
Não. O reconhecimento roda no seu aparelho; só os dados do idioma são baixados uma vez.