> ML_DATASET // VISUAL-GENOME-DATASET_v1.0
Visual Genome: Connecting Language and Vision (Krishna et al. 2017)
Stanford University (Ranjay Krishna et al.) · Visual Relational Knowledge & Scene Graphs · 108,077 images with 5.4M region descriptions, 2.3M visual relationships, and 2.8M attributes
Visual Relational Knowledge & Scene GraphsCC-BY-4.0108,077 images with 5.4M region descriptions, 2.3M visual relationships, and 2.8M attributesopen
Veri Profili ve Özellikler
Etiket Tipi:Scene graphs: localized bounding boxes, attributes, and directed relational predicate triples
Diller:en
Lisans Seviyesi:permissive-open-source
Modaliteler:image, text, graph
Amaçlanan Kullanım (Intended Use)
- Sahne grafiği üretimi, görsel ilişki tespiti ve temellendirilmiş VQA kıyaslaması
Yasaklanan / Kaçınılması Gereken Kullanım
- Yüz tanıma
Önyargı, Veri Sızıntısı ve Gizlilik Risk Analizi
Kişisel Veri Riskleri (Privacy Risks):
Kamuya açık ve özel alanlardaki insan etkinliklerini içeren fotoğraflar.
Bilinen Önyargılar (Known Bias):
Ağır görsel ilişki uzun kuyruğu ("on", "has", "wearing" baskındır).
Veri Sızıntısı Riski (Known Leakage):
MS COCO görüntü kimlikleriyle eşleştirilmiş temiz ayrım.
