Como o computador lê o texto de uma imagem (OCR explicado sem complicação)

Atualizado em 6 de outubro de 2026

Para o computador, uma imagem é só um monte de pontinhos coloridos, sem letras. Os programas que leem texto de imagem, chamados de OCR (sigla em inglês para reconhecimento óptico de caracteres), acham onde estão as linhas e as palavras e comparam cada forma com as letras que aprenderam. O resultado é texto de verdade, que dá para copiar, buscar e editar.

Por que não dá para selecionar o texto de uma imagem

Num texto digitado, o computador guarda cada letra como uma letra. Num print, numa foto ou num PDF escaneado, ele guarda só a cor de cada pontinho da imagem. Você enxerga a palavra "casa", mas para o computador ali não existe nenhum "c", "a", "s" ou "a". É por isso que o cursor não seleciona e o Ctrl+F não acha a palavra.

Como o OCR funciona, passo a passo

  1. Prepara a imagem: aumenta o contraste, separa as letras do fundo e endireita a imagem se ela estiver um pouco torta.
  2. Acha as linhas e as palavras: separa os blocos de texto do resto da imagem, como fotos, ícones e bordas.
  3. Reconhece as letras: um modelo treinado com muitos exemplos de texto olha cada linha e diz quais letras estão ali. Os modelos atuais leem a linha inteira, e não letra por letra, o que ajuda com letras coladas.
  4. Usa o idioma a seu favor: sabendo que o texto é português, ele escolhe melhor entre opções parecidas e acerta os acentos.
  5. Monta o texto: junta as palavras na ordem de leitura, com espaços e quebras de linha.

A nossa ferramenta grátis usa o Tesseract, um programa de OCR gratuito e de código aberto, e faz todos esses passos no seu navegador: a imagem não é enviada para lugar nenhum.

Onde você já usa OCR sem saber

Por que o OCR erra

A qualidade da imagem pesa mais do que o programa. Nos nossos testes com o Pegatexto, a leitura comum acertou 99,4% dos caracteres em prints nítidos e caiu para 48,6% em fotos tortas, imagens borradas e letra de mão. Nessas imagens difíceis, a leitura por IA chegou a 89,6%.

Medimos em 3 de outubro de 2026, com 49 imagens: 47 criadas por nós, com as fontes e o visual de telas reais, e 2 prints reais. Trate os números como referência, não como garantia. Os detalhes estão em Nossos testes.

OCR comum e leitura por IA

Os programas de OCR comuns olham uma linha por vez e funcionam sem internet. Os modelos de IA que leem imagens, do mesmo tipo dos assistentes como o ChatGPT, olham a página inteira e usam o contexto para entender o que está borrado ou torto. Em compensação, precisam de internet e, quando não conseguem ler, podem completar com uma palavra que não está na imagem. Nos dois casos, confira números, nomes e datas.

Quer ver funcionando?

Arraste uma imagem ou cole um print no Conversor de imagem para texto e veja o texto sair em poucos segundos. Para tirar uma foto que o OCR lê bem, veja como fotografar documento para copiar o texto.

Perguntas frequentes

O que significa OCR?

É a sigla em inglês de Optical Character Recognition, ou reconhecimento óptico de caracteres. É o nome técnico para ler o texto que está dentro de uma imagem e transformá-lo em texto editável.

OCR funciona sem internet?

Depende do programa. A Ferramenta de Captura do Windows, o PowerToys, a leitura comum do Pegatexto e a nossa ferramenta no navegador leem no próprio computador. Sites que pedem para enviar o arquivo fazem a leitura num servidor.

OCR lê letra de mão?

Os programas comuns erram bastante em letra de mão. A leitura por IA se sai bem melhor, mas ainda vale conferir o resultado.

OCR é a mesma coisa que inteligência artificial?

OCR é a tarefa de ler texto em imagem. Os programas de OCR atuais já usam redes neurais, que são um tipo de IA. Quando falamos de leitura por IA, são modelos maiores, que entendem a imagem inteira e não só as letras.

Fontes