# Was ist Optical Character Recognition?

> OCR

Technologie, die visuelle Texte in digitalen Text umwandelt, der von einem Computer bearbeitet werden kann.

## Definition
Diese Technologie erkennt Text auf gescannten Dokumenten oder Fotos und wandelt ihn in bearbeitbare Textdateien um. Es fungiert als Brücke, die den Text auf einem Blatt Papier, den Sie mit Ihren Augen sehen, in digitale Zeichen umwandelt, die der Computer verstehen kann. Heutzutage wird es häufig zum Scannen von Rechnungen oder zum Digitalisieren alter Dokumente verwendet.

## So funktioniert es
Das System scannt zunächst das Bild und analysiert die Buchstabenformen. Anschließend ordnet es diese Formen den Zeichen in seiner Datenbank zu. Im letzten Schritt entstehen durch die Kombination dieser Zeichen aussagekräftige Texte.

## Wo es eingesetzt wird
Es dient dazu, gescannte PDF-Dokumente bearbeitbar zu machen, Ausweisinformationen automatisch auszulesen und handschriftliche Notizen zu digitalisieren.

## Häufig verwechselt mit
Im Gegensatz zu Browsern, die das Bild einfach so speichern, wie es ist, wandelt es den Inhalt in Text um.

## Häufige Fragen
**Kann er Handschrift lesen?**
Ja, fortschrittliche Systeme können Handschriften mittlerweile mit hoher Genauigkeit digitalisieren.

**Funktioniert es in allen Sprachen?**
Die meisten Systeme unterstützen gängige Sprachen, spezielle Skripte erfordern jedoch möglicherweise zusätzliches Training.


## Verwandte Begriffe
- [Document Parsing](/de/dictionary/document-parsing/)
- [PDF Parser](/de/dictionary/pdf-parser/)
- [Data Pipeline](/de/dictionary/data-pipeline/)

## Verwandte Werkzeuge
- [PaddleOCR](/de/discover/paddleocr/)

---
Quelle: TreScout Glossar · https://trescout.com/de/dictionary/optical-character-recognition/
