← Glossar
Glossar · AI

Was ist Speech-to-Text?

Dabei handelt es sich um eine Technologie, die gesprochene Wörter abhört und diese automatisch in geschriebenen Text umwandelt.

Definition

Dabei handelt es sich um einen Prozess, der Schallwellen analysiert und in digitale Zeichen umwandelt. Künstliche Intelligenz unterscheidet die Betonungen und Wörter der menschlichen Stimme und wandelt sie in Text um. Heutzutage funktioniert es sehr schnell und fehlerfrei.

Analogie: Es ist wie eine sehr schnelle Schreibkraft, die sich Notizen macht, während man redet.

So funktioniert es

Die von Ihrem Mikrofon kommenden Audiodaten gelangen in das System, künstliche Intelligenz verarbeitet diese Daten und spiegelt sie als Text auf Ihrem Bildschirm wider.

Wo es eingesetzt wird

Es wird in Anwendungen zum Notieren von Besprechungen, Sprachassistenten und Untertitelungstools verwendet.

Häufig verwechselt mit

Es kann mit Text-to-Speech (Text-zu-Sprache-Übersetzung) verwechselt werden; Dies ist der genau gegenteilige Vorgang.

Häufige Fragen

Versteht er jeden Akzent?

Obwohl moderne Modelle die meisten Akzente verstehen, können sie bei sehr seltenen Sprachen oder verzerrten Sprachaufnahmen Fehler machen.

Verwandte Begriffe

Verwandte Werkzeuge

Diese Erklärung wurde für TreScout in einfacher Sprache verfasst und maschinell übersetzt aus dem türkischen Original · maßgeblich ist die türkische Fassung. Wenn etwas falsch oder unvollständig wirkt, schreiben Sie an hello@trescout.com. Auf Türkisch lesen →