← Glosario
Glosario · AI

¿Qué es Speaker Diarization?

Es el proceso de etiquetar a los oradores en el texto distinguiendo quiénes pronunciaron los discursos en la grabación de audio.

Definición

Diarización del orador, '¿quién habló?' responde la pregunta. Si hay más de una persona en la grabación de una reunión, el sistema analiza las diferencias en el tono de voz y separa las conversaciones en "Persona 1", "Persona 2", etc.

Analogía: Es como un espectador de una obra de teatro que reconoce quién habla por su voz cuando se cierra el telón.

Cómo funciona

La IA aprende el timbre y las características de la voz. Realiza un seguimiento de estas firmas de sonido a lo largo de la grabación, marcando las transiciones de los hablantes dentro del texto.

Dónde se usa

Se utiliza en análisis de podcasts, grabaciones judiciales y resúmenes de reuniones con varios participantes.

Suele confundirse con

No confundir con Transcripción, que simplemente transcribe audio; este proceso agrega "quién" habla además del texto.

Preguntas frecuentes

¿Se le ocurren al orador sus propios nombres?

No, suele distinguir entre hablantes (persona A, persona B). Debes introducir los nombres en el sistema.

Términos relacionados

Herramientas relacionadas

Esta explicación se redactó en lenguaje sencillo para TreScout y se tradujo automáticamente del original en turco · prevalece la versión turca. Si algo le parece erróneo o incompleto, escriba a hello@trescout.com. Leer en turco →