# ¿Qué es Speech-to-Text?

Es una tecnología que escucha las palabras habladas y las convierte automáticamente en texto escrito.

## Definición
Es un proceso que analiza las ondas sonoras y las convierte en caracteres digitales. La inteligencia artificial distingue las entonaciones y palabras de la voz humana y las convierte en texto. Hoy en día funciona muy rápido y sin errores.

## Cómo funciona
Los datos de audio provenientes de tu micrófono ingresan al sistema, la inteligencia artificial procesa estos datos y los refleja como texto en tu pantalla.

## Dónde se usa
Se utiliza en aplicaciones para tomar notas en reuniones, asistentes de voz y herramientas de subtítulos.

## Suele confundirse con
Se puede confundir con Text-to-Speech (traducción de texto a voz); Este es exactamente el proceso opuesto.

## Preguntas frecuentes
**¿Entiende cada acento?**
Aunque los modelos modernos entienden la mayoría de los acentos, pueden cometer errores con idiomas muy raros o grabaciones de voz distorsionadas.


## Términos relacionados
- [Text-to-Speech](/es/dictionary/text-to-speech/)
- [Speech Synthesis](/es/dictionary/speech-synthesis/)
- [NLP](/es/dictionary/nlp/)

## Herramientas relacionadas
- [Transcribe.cpp](/es/discover/transcribe-cpp/)

---
Fuente: TreScout Glosario · https://trescout.com/es/dictionary/speech-to-text/
