OCR Grátis · sem cadastro · sem marca d'água

Converter imagem em texto (OCR)

Use o OCR para extrair texto de imagem: fotos, capturas de tela e páginas escaneadas viram texto editável. O motor de OCR roda dentro do seu navegador, então suas imagens nunca saem do seu aparelho.

Updated Krawly Editorial TeamIn-house engineers, writers & reviewers

ou solte os arquivos aqui · cole com Ctrl+V

JPG, PNG, WEBP, BMP, GIF · até 50 MB cada · máx. 20 arquivos

Processado no seu navegador — os arquivos nunca são enviados

Resposta rápida

Para converter uma imagem em texto, solte um arquivo JPG, PNG, WebP, BMP ou GIF na ferramenta Imagem para Texto do Krawly, escolha o idioma do texto (até 3 ao mesmo tempo) e clique em Extrair texto. O motor Tesseract lê a imagem localmente no seu navegador e devolve texto editável, que você copia ou baixa como arquivo .txt. Nada é enviado e não há cadastro.

Como usar a ferramenta Imagem para Texto (OCR)

  1. 1

    Adicione as imagens

    Arraste arquivos JPG, PNG, WebP, BMP ou GIF para a área de envio ou clique para escolhê-los. Você pode adicionar até 20 imagens por vez, por exemplo uma série de capturas de tela ou páginas fotografadas.

  2. 2

    Escolha o idioma do texto

    O inglês vem selecionado por padrão. Escolha o idioma em que o texto está escrito, ou até três idiomas se a imagem misturar vários, como português e inglês num cardápio bilíngue.

  3. 3

    Rode o OCR

    Clique em Extrair texto. Na primeira vez, o navegador baixa o motor de OCR e o modelo do idioma e guarda os dois em cache. Cada imagem é processada no seu aparelho e ganha a sua própria caixa de texto, com uma pontuação de confiança média.

  4. 4

    Revise e corrija

    Os resultados são editáveis. Corrija os caracteres lidos errado direto na caixa de texto antes de usar o texto; uma confiança baixa é sinal de que alguma linha merece uma olhada mais atenta.

  5. 5

    Copie ou baixe

    Clique em Copiar tudo para mandar o texto para a área de transferência, ou em Baixar .txt para salvar os resultados. Quando você processa várias imagens, o download junta tudo em um único arquivo .txt, com um cabeçalho para cada imagem.

Como funciona a conversão de imagem em texto (OCR)?

OCR significa reconhecimento óptico de caracteres (do inglês optical character recognition): um programa analisa os pixels de uma imagem, encontra as áreas que contêm escrita e descobre quais caracteres elas representam. O resultado é texto de verdade, que você pode pesquisar, editar, colar num documento ou jogar numa planilha, em vez de uma foto de texto. Ou seja, dá para copiar texto de imagem sem redigitar nada à mão.

A Krawly usa o Tesseract, um motor de OCR de código aberto com muitos anos de estrada. Ele foi criado na Hewlett-Packard, teve o código aberto em 2005 e depois continuou sendo desenvolvido com patrocínio do Google. Aqui ele roda como Tesseract.js, uma versão compilada para WebAssembly que consegue funcionar dentro de uma página web sem nenhum servidor. De forma simplificada, o motor limpa a imagem até virar texto escuro sobre fundo claro, divide a página em blocos, linhas e palavras e então reconhece cada linha com um modelo treinado para o idioma que você escolheu.

É por causa dessa última etapa que a escolha do idioma importa. Cada idioma tem o seu próprio modelo, com seu alfabeto, suas letras acentuadas e formatos de palavras comuns. Se você manda o motor ler em inglês um texto em português, ele vai tentar mesmo assim, mas letras como ç, ã e é tendem a sair erradas. Escolher o idioma certo, ou uma combinação de até três, é uma das formas mais simples de conseguir resultados mais limpos.

Como tirar texto preciso de uma foto ou captura de tela

O OCR funciona melhor com texto impresso nítido, bom contraste e linhas retas. Capturas de tela costumam ser ideais, porque o texto é nítido e perfeitamente horizontal. Em digitalizações, uns 300 DPI são uma boa meta: alto o bastante para que letras pequenas tenham bordas limpas, sem gerar arquivos enormes. Se for fotografar uma página com o celular para passar a foto em texto, enquadre só o documento, mantenha a câmera paralela ao papel e evite sombras da sua mão ou do próprio celular.

Contraste importa mais que cor. Texto preto em papel branco é fácil; texto cinza-claro em fundo bege, ou texto branco sobre uma foto cheia de detalhes, é bem mais difícil. Se o resultado sair ruim, tente recortar a imagem só na área do texto, girá-la para deixar as linhas retas e aumentar o contraste em qualquer editor de fotos antes de rodar o OCR de novo. Linhas tortas, curvas ou distorcidas pela perspectiva, como numa página fotografada perto da lombada do livro, são uma causa comum de palavras faltando.

Texto muito pequeno é outro problema frequente. Quando as letras têm só alguns pixels de altura, não há detalhe suficiente para diferenciar um e de um c ou um l de um 1. Dar zoom antes de fazer a captura de tela, ou digitalizar com resolução maior, costuma ajudar mais do que qualquer edição posterior. Lembre que ampliar uma imagem que já é pequena não cria detalhes que nunca foram capturados.

O que o OCR não faz: letra de mão, tabelas e layout

O Tesseract foi feito para texto impresso. Letra de mão, anotações em letra cursiva, assinaturas e fontes muito estilizadas ou decorativas costumam dar resultados ruins ou inúteis. O mesmo vale para fotos em baixa resolução, tremidas ou muito comprimidas. Se a sua imagem se encaixa num desses casos, espere corrigir boa parte do resultado à mão, ou redigitar o texto.

O resultado é texto simples. Colunas, tabelas, negrito e itálico, tamanhos de fonte e imagens não são mantidos. Um artigo em duas colunas vira linhas corridas de texto, e uma tabela vira linhas de palavras separadas por espaços, então talvez você precise arrumar a estrutura depois de colar em outro lugar. Esta ferramenta não gera documentos do Word nem planilhas.

Cada imagem também recebe uma porcentagem de confiança média. É a estimativa do próprio motor sobre o quanto ele tinha certeza das palavras reconhecidas, não uma garantia de precisão, mas é um sinal útil: uma pontuação visivelmente mais baixa geralmente indica que a imagem precisa ficar mais nítida, mais reta ou mais bem recortada.

É seguro fazer OCR de prints, documentos e recibos?

Muita gente usa OCR em material sensível: recibos para prestação de contas, prints de conversas ou de apps de banco, notas fiscais, contratos, documentos de identidade e cartas. Muitos serviços de OCR online enviam essas imagens para um servidor processar. A Krawly não. O reconhecimento roda inteiramente no seu navegador com JavaScript e WebAssembly, e suas imagens nunca são enviadas para os servidores do Krawly.

As únicas coisas que o seu navegador baixa são arquivos de programa: o motor Tesseract e o modelo de cada idioma escolhido, alguns megabytes cada. Depois da primeira vez eles ficam em cache, então as próximas execuções começam mais rápido. A imagem e o texto reconhecido ficam na memória da página, nada é armazenado e, ao fechar a aba, tudo é descartado.

Como o trabalho acontece no seu aparelho, a velocidade depende do seu hardware. Um notebook recente lida rápido com uma captura de tela; um celular mais antigo demora mais em fotos grandes. A ferramenta funciona nas versões atuais do Chrome, Edge, Firefox e Safari, no computador e no celular, e é grátis, sem cadastro, sem e-mail e sem limite diário.

Dicas para os melhores resultados

  • Antes de transformar imagem em texto, recorte só a área que você precisa. Tirar logos, fotos e bordas da página deixa menos coisa para o motor ler errado.
  • Selecione todos os idiomas que aparecem na imagem, até três. Um documento em português com citações em inglês fica melhor com os dois selecionados.
  • Em capturas de tela, dê zoom na página antes de capturar, para as letras ficarem maiores e mais nítidas.
  • Confira linhas com caracteres incomuns, números e pontuação: 0 e O, 1 e l, rn e m são confusões clássicas de OCR.
  • Tem uma foto de iPhone em HEIC? Converta antes com a ferramenta HEIC para JPG e depois rode o OCR no JPG.
  • Para um PDF escaneado, use PDF para Texto em vez de tirar print de cada página. Ele lê o texto embutido quando existe e só roda o OCR onde é necessário.

Perguntas frequentes

O OCR consegue ler letra de mão?

Não de forma confiável. O motor Tesseract foi feito para texto impresso, então anotações à mão, letra cursiva e assinaturas costumam sair como caracteres quebrados ou errados. Letras de forma maiúsculas bem caprichadas às vezes funcionam em parte. Para letra de mão, redigitar costuma ser mais rápido do que corrigir o resultado do OCR.

Quais idiomas são suportados?

Inglês, espanhol, português, francês, alemão, italiano, holandês, turco, polonês, russo, ucraniano, árabe, hindi, japonês, chinês (simplificado), chinês (tradicional), coreano, vietnamita e indonésio. Você pode selecionar até três idiomas ao mesmo tempo para imagens que misturam idiomas.

Minhas imagens são enviadas para algum servidor?

Não. O OCR roda no seu navegador usando o Tesseract compilado para WebAssembly. O navegador baixa o motor e os arquivos de idioma, mas suas imagens e o texto extraído nunca saem do seu aparelho. Nada é armazenado, e fechar a aba apaga tudo.

Por que a primeira vez é mais lenta?

Na primeira vez que você usa a ferramenta, o navegador baixa o motor de OCR e o modelo de cada idioma selecionado, alguns megabytes por idioma. Esses arquivos ficam em cache, então as próximas execuções com os mesmos idiomas começam bem mais rápido. Escolher um idioma novo dispara um download único desse modelo.

Quantas imagens posso converter de uma vez?

Até 20 imagens por vez, cada uma com até 50 MB. Cada imagem ganha a sua própria caixa de texto editável, e Baixar .txt junta todos os resultados em um único arquivo de texto, com um cabeçalho por imagem. Não há limite diário, então você pode começar outra rodada na hora.

Quais formatos de imagem posso usar?

JPG, PNG, WebP, BMP e GIF, com até 50 MB cada. Capturas de tela salvas em PNG costumam ser a melhor entrada, porque o texto é nítido. Fotos HEIC do iPhone não são aceitas diretamente; converta-as antes com a ferramenta HEIC para JPG e depois rode o OCR no JPG.

O OCR mantém tabelas e formatação?

Não. O resultado é texto simples. Colunas são achatadas, tabelas viram linhas de palavras separadas por espaços, e fontes, negrito e imagens são descartados. Você pode editar o texto na caixa de resultado antes de copiar, ou arrumá-lo no seu próprio editor.

O que significa a porcentagem de confiança?

É a confiança média do motor nas palavras que ele reconheceu naquela imagem. Não é um número de precisão medido, mas uma pontuação mais baixa é um bom sinal de que a imagem está borrada, torta, com pouco contraste ou num idioma diferente do selecionado.

Privado por padrão. Todos os conversores do Krawly rodam dentro do seu navegador com JavaScript e WebAssembly. Seus arquivos não são enviados, armazenados nem vistos por ninguém — ao fechar a aba, eles somem.

Conversores relacionados

Ver todos os 21 conversores grátis