OCR
É a abreviação de "Optical Character Recognition". O OCR é uma tecnologia que reconhece texto em uma imagem digital. Ele é comumente usado para reconhecer texto em documentos digitalizados, mas também serve para muitas outras finalidades.
O software de OCR processa uma imagem digital localizando e reconhecendo caracteres, como letras, números e símbolos. Alguns softwares de OCR simplesmente exportam o texto, enquanto outros programas podem converter os caracteres diretamente na imagem em texto editável. Softwares de OCR avançados podem exportar o tamanho e a formatação do texto, além do layout do texto encontrado em uma página.
A tecnologia de OCR pode ser usada para converter uma cópia impressa de um documento em uma versão eletrônica ou (cópia digital). Por exemplo, se você digitalizar um documento com várias páginas em uma imagem digital, como um arquivo TIFF, poderá carregar o documento em um programa de OCR, que reconhecerá o texto e converterá o documento em um arquivo de texto editável. Alguns programas de OCR permitem digitalizar um documento e convertê-lo em um documento de processamento de texto em uma única etapa.
Embora a tecnologia de OCR tenha sido originalmente projetada para reconhecer texto impresso, ela também pode ser usada para reconhecer e verificar texto manuscrito. Por exemplo, serviços postais como o USPS usam software de OCR para processar automaticamente cartas e pacotes com base no endereço. O algoritmo compara as informações digitalizadas com o banco de dados de endereços existentes para confirmar o endereço postal. O app Google Tradutor inclui tecnologia de OCR que funciona com a câmera do seu dispositivo. Ele permite capturar o texto de documentos, revistas, placas e outros objetos e traduzi-lo para outro idioma em tempo real.
Teste seus conhecimentos