# Was ist Speaker Diarization?

Dabei handelt es sich um den Prozess der Kennzeichnung von Rednern im Text, indem in der Audioaufnahme unterschieden wird, wer die Reden gehalten hat.

## Definition
Sprecherdiarisierung: „Wer hat gesprochen?“ beantwortet die Frage. Wenn in einer Besprechungsaufzeichnung mehr als eine Person anwesend ist, analysiert das System Unterschiede im Stimmton und unterteilt die Gespräche in „Person 1“, „Person 2“ usw.

## So funktioniert es
KI lernt die Klangfarbe und Eigenschaften der Stimme. Es verfolgt diese Tonsignaturen während der gesamten Aufnahme und markiert Sprecherübergänge innerhalb des Textes.

## Wo es eingesetzt wird
Wird für Podcast-Analysen, Gerichtsaufzeichnungen und Zusammenfassungen von Besprechungen mit mehreren Teilnehmern verwendet.

## Häufig verwechselt mit
Nicht zu verwechseln mit der Transkription, bei der einfach Audio transkribiert wird. Dieser Prozess fügt zusätzlich zum Text hinzu, wer spricht.

## Häufige Fragen
**Überlegt sich der Sprecher eigene Namen?**
Nein, es wird normalerweise zwischen Sprechern (Person A, Person B) unterschieden. Sie müssen die Namen in das System eingeben.


## Verwandte Begriffe
- [Transcription](/de/dictionary/transcription/)
- [Speech-to-Text](/de/dictionary/speech-to-text/)
- [NLP](/de/dictionary/nlp/)

## Verwandte Werkzeuge
- [Meetily](/de/discover/meetily/)

---
Quelle: TreScout Glossar · https://trescout.com/de/dictionary/speaker-diarization/
