← Glossar
Glossar · Data

Was ist Optical Character Recognition?

OCR

Technologie, die visuelle Texte in digitalen Text umwandelt, der von einem Computer bearbeitet werden kann.

Definition

Diese Technologie erkennt Text auf gescannten Dokumenten oder Fotos und wandelt ihn in bearbeitbare Textdateien um. Es fungiert als Brücke, die den Text auf einem Blatt Papier, den Sie mit Ihren Augen sehen, in digitale Zeichen umwandelt, die der Computer verstehen kann. Heutzutage wird es häufig zum Scannen von Rechnungen oder zum Digitalisieren alter Dokumente verwendet.

Analogie: Es ist wie eine Zauberbrille, die ein Foto eines Buches aufnehmen und den Text in diesem Foto kopieren und in eine Word-Datei einfügen kann.

So funktioniert es

Das System scannt zunächst das Bild und analysiert die Buchstabenformen. Anschließend ordnet es diese Formen den Zeichen in seiner Datenbank zu. Im letzten Schritt entstehen durch die Kombination dieser Zeichen aussagekräftige Texte.

Wo es eingesetzt wird

Es dient dazu, gescannte PDF-Dokumente bearbeitbar zu machen, Ausweisinformationen automatisch auszulesen und handschriftliche Notizen zu digitalisieren.

Häufig verwechselt mit

Im Gegensatz zu Browsern, die das Bild einfach so speichern, wie es ist, wandelt es den Inhalt in Text um.

Häufige Fragen

Kann er Handschrift lesen?

Ja, fortschrittliche Systeme können Handschriften mittlerweile mit hoher Genauigkeit digitalisieren.

Funktioniert es in allen Sprachen?

Die meisten Systeme unterstützen gängige Sprachen, spezielle Skripte erfordern jedoch möglicherweise zusätzliches Training.

Verwandte Begriffe

Verwandte Werkzeuge

Diese Erklärung wurde für TreScout in einfacher Sprache verfasst und maschinell übersetzt aus dem türkischen Original · maßgeblich ist die türkische Fassung. Wenn etwas falsch oder unvollständig wirkt, schreiben Sie an hello@trescout.com. Auf Türkisch lesen →