Skip to main content

> ML_LITERATURE // WANG-2019-SUPERGLUE-STICKIER-BENCHMARK-GENERAL-LANGUAGE-UNDERSTANDING_v1.0

SuperGLUE: A Stickier Benchmark for General-Purpose Language Understanding Systems

Alex Wang, Yada Pruksachatkun, Nikita Nangia, Amanpreet Singh, Julian Michael, Felix Hill, Omer Levy, Samuel R. Bowman · Advances in Neural Information Processing Systems (NeurIPS) (2019)

benchmark2019industry-standardartifactsAvailable

Temel Katkı (Principal Contribution)

BERT orijinal GLUE'yu doyurduktan sonra zorlu akıl yürütme görevleriyle GLUE'nun yerini alan çok daha zor bir kıyaslama tasarladı.

Operasyonel ve Mühendislik Uygunluğu

task-natural-language-inference, task-question-answering için dağıtım seçimlerini ve mimari belirlemeyi doğrudan yönlendirir.

Temel Varsayımlar (Assumptions)

  • Değerlendirme alanları genelinde standart ampirik düzenlilik ve istatistiksel kararlılık geçerlidir

Kısıtlar ve Sınırlamalar (Limitations)

  • Performans özellikleri alan dağılımına ve hesaplama tahsisi parametrelerine bağlıdır

Bağlantılı Algoritmalar, Mimariler ve Kütüphaneler

İlgili Algoritmalar:
İlgili Mimariler:
Uygulayıcı Kütüphaneler: