Skip to main content

> ML_LITERATURE // WANG-2018-GLUE-MULTI-TASK-BENCHMARK-ANALYSIS-PLATFORM-NLU_v1.0

GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding

Alex Wang, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman · BlackboxNLP Workshop at EMNLP (2018)

benchmark2018industry-standardartifactsAvailable

Temel Katkı (Principal Contribution)

Genel dil temsilleri için tek bir birleşik değerlendirme liderlik tablosu ile 9 farklı NLU görevini bir araya getirdi.

Operasyonel ve Mühendislik Uygunluğu

task-text-classification, task-natural-language-inference için dağıtım seçimlerini ve mimari belirlemeyi doğrudan yönlendirir.

Temel Varsayımlar (Assumptions)

  • Değerlendirme alanları genelinde standart ampirik düzenlilik ve istatistiksel kararlılık geçerlidir

Kısıtlar ve Sınırlamalar (Limitations)

  • Performans özellikleri alan dağılımına ve hesaplama tahsisi parametrelerine bağlıdır

Bağlantılı Algoritmalar, Mimariler ve Kütüphaneler

İlgili Algoritmalar:
İlgili Mimariler:
Uygulayıcı Kütüphaneler: