Sintetizador de voz ligero con IA que se ejecuta en la CPU
Desarrollado por Kyutai Labs, Pocket-TTS es un modelo ligero de conversión de texto a voz que se ejecuta únicamente en la unidad central de procesamiento (CPU) sin necesidad de una unidad de procesamiento de gráficos. Gracias a su bajo consumo de recursos, ofrece una síntesis de sonido rápida y eficiente en dispositivos con restricciones de hardware.
Actualizaciones
- 4 de septiembre de 2026: Estrellas 9,151 → 9,348, última versión v3.1.0 (3 de septiembre de 2026).
- 27 de agosto de 2026: Estrellas 7,994 → 9,151, última versión v3.0.2 (25 de agosto de 2026).
- 2 de agosto de 2026: Estrellas 6,350 → 7,994, última versión v2.1.0 (4 de mayo de 2026).
Qué aporta
- Funciona sólo con el procesador, sin necesidad de tarjeta gráfica
- Proporciona una reproducción de sonido rápida con un bajo consumo de recursos.
- Ofrece clonación de voz y soporte en varios idiomas.
Instalación
pip install pocket-tts
# or
uv add pocket-ttsEjecución
uvx pocket-tts generate
# or if you installed it manually with pip:
pocket-tts generateuvx pocket-tts serve
# or if you installed it manually with pip:
pocket-tts serveSi no programa
Quiero convertir texto a voz usando la herramienta Pocket TTS. Explicar cómo configurar los comandos necesarios y el modelo de sonido para producir rápidamente un archivo de audio en mi computadora usando solo la potencia del procesador. En particular, explique paso a paso cómo puedo cambiar la configuración de audio predeterminada y clonar mi audio usando mi propio archivo de audio.
Términos relacionados del glosario
Enlaces
TreScout no desarrolló esta herramienta · la encontramos en las tendencias de GitHub y la presentamos. Esta página describe el repositorio tal como estaba el 2026-07-08: El número de estrellas y nuestro texto son de ese día, el repositorio puede haber cambiado desde entonces. Consulte el enlace del repositorio para ver el estado actual. Esta página se tradujo automáticamente del original en turco · prevalece la versión turca.