Transcribe sonidos con inteligencia artificial
Desarrollado por OpenAI, Whisper es un modelo de reconocimiento de voz entrenado mediante un método de aprendizaje de supervisión débil a gran escala. Ofrece altas tasas de precisión en la conversión y traducción de datos de audio multilingües a texto.
Actualizaciones
- 2 de agosto de 2026: Estrellas 101,952 → 106,452, última versión v20250625 (26 de junio de 2025).
Qué aporta
- Convierta archivos de audio a texto con alta precisión.
- Traducir conversaciones de diferentes idiomas al inglés.
- Identificación del idioma y detección de actividad del habla en contenido de audio.
Instalación
sudo apt update && sudo apt install ffmpegpip install setuptools-rustpip install openai-whisperEjecución
whisper audio.flac --model turboSi no programa
Quiero convertir mi archivo de audio en texto usando la herramienta Whisper. Hice las instalaciones necesarias en mi sistema. ¿Cuál es la estructura de comando básica que necesito escribir en la terminal para traducir el contenido de mi archivo de audio a texto y cómo debo usar el parámetro de especificación de idioma para archivos de audio en diferentes idiomas?
Términos relacionados del glosario
Enlaces
TreScout no desarrolló esta herramienta · la encontramos en las tendencias de GitHub y la presentamos. Esta página describe el repositorio tal como estaba el 2026-06-07: El número de estrellas y nuestro texto son de ese día, el repositorio puede haber cambiado desde entonces. Consulte el enlace del repositorio para ver el estado actual. Esta página se tradujo automáticamente del original en turco · prevalece la versión turca.