> ML_LITERATURE // ALAYRAC-2022-FLAMINGO-VISUAL-LANGUAGE-MODEL_v1.0
Flamingo: a Visual Language Model for Few-Shot Learning
Jean-Baptiste Alayrac, Jeff Donahue, Pauline Luc, Antoine Miech, Iain Barr, Yana Hasson, Karel Lenc, Arthur Mensch, Katie Millican, Malcolm Reynolds, Roman Ring, Eliza Rutherford, Serkan Cabi, Tengda Han, Zhitao Gong, Sina Samangooei, Marianne Monteiro, Jacob Menick, Sebastian Borgeaud, Andrew Brock, Aida Nematzadeh, Sahand Sharifzadeh, Mikolaj Binkowski, Ricardo Barreira, Oriol Vinyals, Andrew Zisserman, Karen Simonyan · Advances in Neural Information Processing Systems (NeurIPS) (2022)
Temel Katkı (Principal Contribution)
Dondurulmuş önceden eğitilmiş görü omurgalarını ve dil modellerini geçitli çapraz dikkat katmanları ve Perceiver Yeniden Örnekleyici ile birbirine bağladı.
Operasyonel ve Mühendislik Uygunluğu
Üretim sistemlerinde task-multimodal, task-question-answering uygulaması için yetkili referans olarak hizmet eder.
Temel Varsayımlar (Assumptions)
- Temel uzamsal-zamansal süreklilik ve alan dağılımsal kararlılığı geçerlidir
Kısıtlar ve Sınırlamalar (Limitations)
- Performans ölçekleme ve hesaplama ayak izi algılama alanı derinliğine, dizi uzunluğuna ve çözünürlüğe bağlıdır
