OCR

Também conhecido como: Reconhecimento Óptico de Caracteres · Optical Character Recognition

OCR é a tecnologia que reconhece letras dentro de uma imagem e as transforma em texto editável e pesquisável. É o que permite copiar o conteúdo de um documento escaneado.

Quando você escaneia um contrato ou fotografa uma conta de luz, o computador não enxerga palavras. Enxerga uma grade de pixels claros e escuros. Para o programa, aquilo é uma figura como qualquer outra — não dá para selecionar, copiar nem localizar com Ctrl+F. O OCR resolve exatamente esse problema: analisa a imagem, identifica onde há caracteres e devolve o texto correspondente.

A sigla vem do inglês Optical Character Recognition, que em português virou Reconhecimento Óptico de Caracteres. O nome é literal. A tecnologia existe desde os anos 1950, mas só ficou boa de verdade nas últimas duas décadas, quando os motores passaram a usar redes neurais em vez de comparar formas com um catálogo fixo de letras.

Como funciona

O processo acontece em etapas. Primeiro vem o pré-processamento: o software endireita a página torta, aumenta o contraste e limpa manchas do escaneamento. Depois ele separa a imagem em blocos — parágrafos, colunas, tabelas — e dentro de cada bloco isola linhas e caracteres individuais.

Aí começa o reconhecimento propriamente dito. Cada caractere isolado é comparado com padrões aprendidos pelo modelo. O motor calcula probabilidades: aquele borrão tem 94% de chance de ser um “a”, 3% de ser um “o”. Por último entra a correção por dicionário e contexto, que conserta boa parte dos erros. É por isso que o OCR sabe que “rnédico” na verdade é “médico” — as letras “r” e “n” grudadas parecem um “m”.

A qualidade do resultado depende quase toda da imagem de entrada. Um escaneamento em 300 PPP, reto e bem iluminado, costuma passar de 98% de acerto. Uma foto tremida de celular, com sombra atravessando a página, pode gerar um texto que ninguém aproveita.

Na prática

Você baixa o extrato do INSS pelo Meu INSS, tenta buscar o número do benefício com Ctrl+F e não encontra nada — mesmo vendo o número na tela. Isso acontece porque o arquivo é uma imagem embrulhada em PDF. Passando o documento pelo OCR, o texto vira selecionável e a busca funciona.

O mesmo vale para o acervo de notas fiscais que o contador pede em janeiro, para as cópias de RG que o cartório digitalizou e para aquela apostila fotocopiada que virou PDF. Se o texto não seleciona no PDF, o OCR é o caminho.

OCR não é tradução nem correção

Vale separar bem o que a ferramenta faz. O OCR lê o que está escrito, sem julgar. Se o documento original tem um erro de digitação, o erro atravessa intacto. Se a página tem carimbo por cima do texto, o motor pode devolver caracteres misturados naquele trecho.

Para conhecer os detalhes do funcionamento e as limitações de cada tipo de documento, o guia completo sobre OCR entra mais fundo.

Receba dicas e novidades sobre PDF e produtividade

Cadastre-se e receba conteúdos exclusivos direto no seu e-mail. Sem spam.