OCR
Steht für „Optical Character Recognition“. OCR ist eine Technologie, die Text in einem digitalen Bild erkennt. Sie wird häufig verwendet, um Text in gescannten Dokumenten zu erkennen, dient aber auch vielen anderen Zwecken.
OCR-Software verarbeitet ein digitales Bild, indem sie Zeichen wie Buchstaben, Zahlen und Symbole lokalisiert und erkennt. Manche OCR-Software exportiert den Text einfach, während andere Programme die Zeichen direkt im Bild in bearbeitbaren Text umwandeln können. Fortschrittliche OCR-Software kann neben der Größe und Formatierung des Textes auch die Anordnung des Textes auf einer Seite exportieren.
OCR-Technologie kann verwendet werden, um eine Papierkopie eines Dokuments in eine elektronische Version oder (elektronische Kopie) umzuwandeln. Wenn Sie beispielsweise ein mehrseitiges Dokument als digitales Bild, etwa als TIFF-Datei, einscannen, können Sie das Dokument in ein OCR-Programm laden. Dieses erkennt den Text und wandelt das Dokument in eine bearbeitbare Textdatei um. Einige OCR-Programme ermöglichen es, ein Dokument einzuscannen und es in einem einzigen Schritt in ein Textverarbeitungs dokument umzuwandeln.
Während OCR-Technologie ursprünglich zur Erkennung von gedrucktem Text entwickelt wurde, kann sie auch zur Erkennung und Überprüfung handschriftlicher Texte verwendet werden. Postdienste wie USPS verwenden beispielsweise OCR-Software, um Briefe und Pakete anhand der Adresse automatisch zu verarbeiten. Der Algorithmus vergleicht die gescannten Informationen mit der Datenbank vorhandener Adressen, um die Postanschrift zu bestätigen. Die Google-Translate-App enthält OCR-Technologie, die mit der Kamera Ihres Geräts funktioniert. Damit können Sie Text aus Dokumenten, Zeitschriften, Schildern und anderen Objekten erfassen und ihn in Echtzeit in eine andere Sprache übersetzen.
Testen Sie Ihr Wissen