# ¿Qué es Text-to-Speech?

> TTS

Es la vocalización de textos escritos con voz humana mediante inteligencia artificial.

## Definición
Text-to-Speech es una tecnología que permite que la inteligencia artificial lea textos escritos con una voz humana natural y fluida. Esta tecnología proporciona una gran comodidad para quienes tienen dificultades para leer o tienen las manos ocupadas.

## Cómo funciona
Se analiza el texto escrito, se determinan los acentos y las entonaciones. Luego, el modelo de inteligencia artificial convierte este texto en ondas sonoras y lo hace audible a través del altavoz.

## Dónde se usa
Se utiliza constantemente en aplicaciones de audiolibros, dispositivos de navegación y asistentes digitales.

## Suele confundirse con
Se mezcla con grabación de audio; Sin embargo, esta tecnología no es un sonido pregrabado, sino un sonido producido instantáneamente.

## Preguntas frecuentes
**¿Por qué a veces las voces suenan robóticas?**
La naturalidad puede variar según la calidad del modelo utilizado y la diversidad del conjunto de datos sobre el que se entrena.

**¿Puedo usar mi propia voz?**
Sí, con las tecnologías de clonación de voz puedes introducir tu propia voz en el sistema y hacer que los textos se lean con tu propia voz.


## Términos relacionados
- [Speech Synthesis](/es/dictionary/speech-synthesis/)
- [Voice Cloning](/es/dictionary/voice-cloning/)
- [AI Skills](/es/dictionary/ai-skills/)

## Herramientas relacionadas
- [Voicebox](/es/discover/voicebox/)
- [VoxCPM](/es/discover/voxcpm/)
- [Pocket TTS](/es/discover/pocket-tts/)
- [MOSS-TTS](/es/discover/moss-tts/)

---
Fuente: TreScout Glosario · https://trescout.com/es/dictionary/text-to-speech/
