OCR
Skrót od „Optical Character Recognition”. OCR to technologia rozpoznająca tekst na obrazie cyfrowym. Jest powszechnie używana do rozpoznawania tekstu w zeskanowanych dokumentach, ale ma również wiele innych zastosowań.
Oprogramowanie OCR przetwarza obraz cyfrowy, lokalizując i rozpoznając znaki, takie jak litery, cyfry i symbole. Niektóre programy OCR po prostu eksportują tekst, podczas gdy inne mogą bezpośrednio przekształcać znaki w tekst, który można edytować na obrazie. Zaawansowane oprogramowanie OCR może eksportować rozmiar i formatowanie tekstu, a także układ tekstu znajdującego się na stronie.
Technologia OCR może służyć do przekształcania dokumentu papierowego w wersję elektroniczną czyli (dokument elektroniczny). Jeśli na przykład zeskanujesz wielostronicowy dokument do obrazu cyfrowego, takiego jak plik TIFF, możesz wczytać dokument do programu OCR, który rozpozna tekst i przekształci dokument w edytowalny plik tekstowy. Niektóre programy OCR umożliwiają zeskanowanie dokumentu i przekształcenie go w dokument edytora tekstu w jednym kroku.
Chociaż technologia OCR została pierwotnie zaprojektowana do rozpoznawania tekstu drukowanego, można jej również używać do rozpoznawania i weryfikowania tekstu odręcznego. Na przykład usługi pocztowe, takie jak USPS, używają oprogramowania OCR do automatycznego przetwarzania listów i paczek na podstawie adresu. Algorytm porównuje zeskanowane informacje z bazą danych istniejących adresów, aby potwierdzić adres wysyłkowy. Aplikacja Tłumacz Google zawiera technologię OCR współpracującą z aparatem urządzenia. Umożliwia ona przechwytywanie tekstu z dokumentów, czasopism, znaków i innych obiektów oraz tłumaczenie go na inny język w czasie rzeczywistym.
Sprawdź swoją wiedzę