# Was ist Speech-to-Text?

Dabei handelt es sich um eine Technologie, die gesprochene Wörter abhört und diese automatisch in geschriebenen Text umwandelt.

## Definition
Dabei handelt es sich um einen Prozess, der Schallwellen analysiert und in digitale Zeichen umwandelt. Künstliche Intelligenz unterscheidet die Betonungen und Wörter der menschlichen Stimme und wandelt sie in Text um. Heutzutage funktioniert es sehr schnell und fehlerfrei.

## So funktioniert es
Die von Ihrem Mikrofon kommenden Audiodaten gelangen in das System, künstliche Intelligenz verarbeitet diese Daten und spiegelt sie als Text auf Ihrem Bildschirm wider.

## Wo es eingesetzt wird
Es wird in Anwendungen zum Notieren von Besprechungen, Sprachassistenten und Untertitelungstools verwendet.

## Häufig verwechselt mit
Es kann mit Text-to-Speech (Text-zu-Sprache-Übersetzung) verwechselt werden; Dies ist der genau gegenteilige Vorgang.

## Häufige Fragen
**Versteht er jeden Akzent?**
Obwohl moderne Modelle die meisten Akzente verstehen, können sie bei sehr seltenen Sprachen oder verzerrten Sprachaufnahmen Fehler machen.


## Verwandte Begriffe
- [Text-to-Speech](/de/dictionary/text-to-speech/)
- [Speech Synthesis](/de/dictionary/speech-synthesis/)
- [NLP](/de/dictionary/nlp/)

## Verwandte Werkzeuge
- [Transcribe.cpp](/de/discover/transcribe-cpp/)

---
Quelle: TreScout Glossar · https://trescout.com/de/dictionary/speech-to-text/
