# ¿Qué es STT?

> Speech-to-Text

Es tecnología que escucha palabras habladas y las convierte en texto escrito.

## Definición
STT analiza las ondas sonoras y las traduce en palabras que la computadora puede entender. Estos sistemas producen texto analizando las entonaciones y los acentos del habla humana.

## Cómo funciona
Los datos de voz se reciben a través del micrófono, la inteligencia artificial analiza esta voz y escribe los textos correspondientes en la pantalla.

## Dónde se usa
Se utiliza en aplicaciones para tomar notas en reuniones, sistemas de comando de voz y herramientas de subtítulos.

## Suele confundirse con
Mezclado con síntesis de voz (Text-to-Speech); Uno convierte sonido en texto y el otro convierte texto en sonido.

## Preguntas frecuentes
**¿Puede entender diferentes idiomas?**
Sí, los modelos STT modernos admiten muchos idiomas y acentos.

**¿Funciona en ambientes ruidosos?**
Los modelos avanzados pueden filtrar el ruido de fondo, pero el margen de error puede aumentar en entornos muy ruidosos.


## Términos relacionados
- [Speech-to-Text](/es/dictionary/speech-to-text/)
- [Voice Cloning](/es/dictionary/voice-cloning/)
- [Whisper](/es/dictionary/whisper/)

## Herramientas relacionadas
- [Agents](/es/discover/agents/)
- [Speech to Speech](/es/discover/speech-to-speech/)
- [Transcribe.cpp](/es/discover/transcribe-cpp/)

---
Fuente: TreScout Glosario · https://trescout.com/es/dictionary/stt/
