¿Qué es Speaker Diarization?
Es el proceso de etiquetar a los oradores en el texto distinguiendo quiénes pronunciaron los discursos en la grabación de audio.
Definición
Diarización del orador, '¿quién habló?' responde la pregunta. Si hay más de una persona en la grabación de una reunión, el sistema analiza las diferencias en el tono de voz y separa las conversaciones en "Persona 1", "Persona 2", etc.
Cómo funciona
La IA aprende el timbre y las características de la voz. Realiza un seguimiento de estas firmas de sonido a lo largo de la grabación, marcando las transiciones de los hablantes dentro del texto.
Dónde se usa
Se utiliza en análisis de podcasts, grabaciones judiciales y resúmenes de reuniones con varios participantes.
Suele confundirse con
No confundir con Transcripción, que simplemente transcribe audio; este proceso agrega "quién" habla además del texto.
Preguntas frecuentes
¿Se le ocurren al orador sus propios nombres?
No, suele distinguir entre hablantes (persona A, persona B). Debes introducir los nombres en el sistema.
Términos relacionados
Herramientas relacionadas
Esta explicación se redactó en lenguaje sencillo para TreScout y se tradujo automáticamente del original en turco · prevalece la versión turca. Si algo le parece erróneo o incompleto, escriba a hello@trescout.com. Leer en turco →