Qu'est-ce que Speaker Diarization ?
Il s'agit du processus d'étiquetage des locuteurs sur le texte en distinguant ceux qui ont prononcé les discours dans l'enregistrement audio.
Définition
Diarisation du haut-parleur, « qui a parlé ? » répond à la question. S'il y a plus d'une personne dans un enregistrement de réunion, le système analyse les différences de ton de voix et sépare les conversations en « Personne 1 », « Personne 2 », etc.
Comment ça marche
L'IA apprend le timbre et les caractéristiques de la voix. Il suit ces signatures sonores tout au long de l'enregistrement, marquant les transitions des locuteurs dans le texte.
Où est-ce utilisé
Utilisé dans l'analyse des podcasts, les enregistrements judiciaires et les résumés de réunions multi-participants.
Souvent confondu avec
A ne pas confondre avec Transcription, qui transcrit simplement l'audio ; Ce processus ajoute « qui » parle en plus du texte.
Questions fréquentes
L'orateur propose-t-il ses propres noms ?
Non, il fait généralement la distinction entre les locuteurs (personne A, personne B). Vous devez introduire les noms dans le système.
Termes liés
Outils liés
This explanation was written in plain language for TreScout · translated from the Turkish original. If something looks wrong or missing, write to hello@trescout.com. Read in Turkish →