> ML_BENCHMARK // LIBRISPEECH-WORD-ERROR-RATE_v1.0
LibriSpeech ASR Word Error Rate (WER)
Speech Recognition · task-speech-recognition · near-saturation
Speech Recognitionnear-saturationmoderate
Değerlendirme Protokolü
Dil modeli yeniden puanlaması olmaksızın test-clean ve gürültülü test-other ayrımlarında standart kod çözme değerlendirmesi.
Temel Model & Metrikler
Kanonik Temel (Baseline):Kaldi (hybrid): 3.8% clean | wav2vec 2.0: 1.8% clean / 3.9% other | Whisper Large-v3: 1.5% clean / 2.7% other
Değerlendirilen Metrikler:
Word Error Rate (WER % on test-clean and test-other)
Eğitim Verisi Kirliliği ve Sızıntı
Clean ve other ayrımları kesinlikle konuşmacıdan bağımsızdır.
Tekrarlanabilirlik Endişeleri
Metin normalleştirme kuralları (büyük/küçük harf, noktalama, sayı yazımı) WER'i %2'ye kadar değiştirebilir.
BAĞLANTILI VERİ KÜMESİLibriSpeech ASR Corpus (Panayotov et al. 2015)Speech Recognition & Acoustic Modeling · 1,000 hours of 16kHz read English audiobooks with aligned text transcripts
Veri Kümesini İncele