Sesleri yapay zekâ ile yazıya dökün
OpenAI tarafından geliştirilen Whisper, geniş ölçekli zayıf denetimli öğrenme (weak supervision) yöntemiyle eğitilmiş bir konuşma tanıma (speech recognition) modelidir. Çok dilli ses verilerini metne dönüştürme ve çeviri yapma süreçlerinde yüksek doğruluk oranları sunar.
Güncelleme
- 2 Ağustos 2026: Yıldız 101.952 → 106.452, son sürüm v20250625 (26 Haziran 2025).
Ne kazandırır?
- Ses dosyalarını yüksek doğrulukla metne dönüştürme.
- Farklı dillerdeki konuşmaları İngilizceye çevirme.
- Sesli içeriklerde dil tanımlama ve konuşma etkinliği tespiti.
Kurulum
sudo apt update && sudo apt install ffmpegpip install setuptools-rustÇalıştırma
whisper audio.flac audio.mp3 audio.wav --model turbowhisper japanese.wav --language JapaneseKod bilmiyorsanız
Whisper aracını kullanarak elimdeki ses dosyasını metne dönüştürmek istiyorum. Sistemimde gerekli kurulumları yaptım. Ses dosyamın içeriğini metne çevirmek için terminale yazmam gereken temel komut yapısı nedir ve farklı dillerdeki ses dosyaları için dil belirtme parametresini nasıl kullanmalıyım?
Bağlantılar
TreScout bu aracı geliştirmedi · GitHub trendlerinde keşfedip Türkçe tanıttı. Bu sayfa deponun 2026-06-07 tarihindeki hâlini anlatır: Yıldız sayısı ve yazdığımız metin o güne aittir, depo sonrasında değişmiş olabilir. Güncel durum için depo bağlantısına bakın.