← Glossar
Glossar · AI

Was ist Speaker Diarization?

Dabei handelt es sich um den Prozess der Kennzeichnung von Rednern im Text, indem in der Audioaufnahme unterschieden wird, wer die Reden gehalten hat.

Definition

Sprecherdiarisierung: „Wer hat gesprochen?“ beantwortet die Frage. Wenn in einer Besprechungsaufzeichnung mehr als eine Person anwesend ist, analysiert das System Unterschiede im Stimmton und unterteilt die Gespräche in „Person 1“, „Person 2“ usw.

Analogie: Es ist wie ein Zuschauer in einem Theaterstück, der an seiner Stimme erkennt, wer spricht, wenn der Vorhang geschlossen ist.

So funktioniert es

KI lernt die Klangfarbe und Eigenschaften der Stimme. Es verfolgt diese Tonsignaturen während der gesamten Aufnahme und markiert Sprecherübergänge innerhalb des Textes.

Wo es eingesetzt wird

Wird für Podcast-Analysen, Gerichtsaufzeichnungen und Zusammenfassungen von Besprechungen mit mehreren Teilnehmern verwendet.

Häufig verwechselt mit

Nicht zu verwechseln mit der Transkription, bei der einfach Audio transkribiert wird. Dieser Prozess fügt zusätzlich zum Text hinzu, wer spricht.

Häufige Fragen

Überlegt sich der Sprecher eigene Namen?

Nein, es wird normalerweise zwischen Sprechern (Person A, Person B) unterschieden. Sie müssen die Namen in das System eingeben.

Verwandte Begriffe

Verwandte Werkzeuge

Diese Erklärung wurde für TreScout in einfacher Sprache verfasst und maschinell übersetzt aus dem türkischen Original · maßgeblich ist die türkische Fassung. Wenn etwas falsch oder unvollständig wirkt, schreiben Sie an hello@trescout.com. Auf Türkisch lesen →