Skip to main content

> ML_BENCHMARK // LIBRISPEECH-WORD-ERROR-RATE_v1.0

LibriSpeech ASR Word Error Rate (WER)

Speech Recognition · task-speech-recognition · near-saturation

Speech Recognitionnear-saturationmoderate

Değerlendirme Protokolü

Dil modeli yeniden puanlaması olmaksızın test-clean ve gürültülü test-other ayrımlarında standart kod çözme değerlendirmesi.

Temel Model & Metrikler

Kanonik Temel (Baseline):Kaldi (hybrid): 3.8% clean | wav2vec 2.0: 1.8% clean / 3.9% other | Whisper Large-v3: 1.5% clean / 2.7% other
Değerlendirilen Metrikler:
Word Error Rate (WER % on test-clean and test-other)

Eğitim Verisi Kirliliği ve Sızıntı

Clean ve other ayrımları kesinlikle konuşmacıdan bağımsızdır.

Tekrarlanabilirlik Endişeleri

Metin normalleştirme kuralları (büyük/küçük harf, noktalama, sayı yazımı) WER'i %2'ye kadar değiştirebilir.

BAĞLANTILI VERİ KÜMESİLibriSpeech ASR Corpus (Panayotov et al. 2015)Speech Recognition & Acoustic Modeling · 1,000 hours of 16kHz read English audiobooks with aligned text transcripts
Veri Kümesini İncele