Was ist Speaker Diarization?
Dabei handelt es sich um den Prozess der Kennzeichnung von Rednern im Text, indem in der Audioaufnahme unterschieden wird, wer die Reden gehalten hat.
Definition
Sprecherdiarisierung: „Wer hat gesprochen?“ beantwortet die Frage. Wenn in einer Besprechungsaufzeichnung mehr als eine Person anwesend ist, analysiert das System Unterschiede im Stimmton und unterteilt die Gespräche in „Person 1“, „Person 2“ usw.
So funktioniert es
KI lernt die Klangfarbe und Eigenschaften der Stimme. Es verfolgt diese Tonsignaturen während der gesamten Aufnahme und markiert Sprecherübergänge innerhalb des Textes.
Wo es eingesetzt wird
Wird für Podcast-Analysen, Gerichtsaufzeichnungen und Zusammenfassungen von Besprechungen mit mehreren Teilnehmern verwendet.
Häufig verwechselt mit
Nicht zu verwechseln mit der Transkription, bei der einfach Audio transkribiert wird. Dieser Prozess fügt zusätzlich zum Text hinzu, wer spricht.
Häufige Fragen
Überlegt sich der Sprecher eigene Namen?
Nein, es wird normalerweise zwischen Sprechern (Person A, Person B) unterschieden. Sie müssen die Namen in das System eingeben.
Verwandte Begriffe
Verwandte Werkzeuge
Diese Erklärung wurde für TreScout in einfacher Sprache verfasst und maschinell übersetzt aus dem türkischen Original · maßgeblich ist die türkische Fassung. Wenn etwas falsch oder unvollständig wirkt, schreiben Sie an hello@trescout.com. Auf Türkisch lesen →