> ML_LITERATURE // WANG-2018-GLUE-MULTI-TASK-BENCHMARK-ANALYSIS-PLATFORM-NLU_v1.0
GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding
Alex Wang, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman · BlackboxNLP Workshop at EMNLP (2018)
benchmark2018industry-standardartifactsAvailable
Temel Katkı (Principal Contribution)
Genel dil temsilleri için tek bir birleşik değerlendirme liderlik tablosu ile 9 farklı NLU görevini bir araya getirdi.
Operasyonel ve Mühendislik Uygunluğu
task-text-classification, task-natural-language-inference için dağıtım seçimlerini ve mimari belirlemeyi doğrudan yönlendirir.
Temel Varsayımlar (Assumptions)
- Değerlendirme alanları genelinde standart ampirik düzenlilik ve istatistiksel kararlılık geçerlidir
Kısıtlar ve Sınırlamalar (Limitations)
- Performans özellikleri alan dağılımına ve hesaplama tahsisi parametrelerine bağlıdır
Bağlantılı Algoritmalar, Mimariler ve Kütüphaneler
İlgili Algoritmalar:
İlgili Mimariler:
Uygulayıcı Kütüphaneler:
