Skip to main content

> ML_DATASET // VISUAL-GENOME-DATASET_v1.0

Visual Genome: Connecting Language and Vision (Krishna et al. 2017)

Stanford University (Ranjay Krishna et al.) · Visual Relational Knowledge & Scene Graphs · 108,077 images with 5.4M region descriptions, 2.3M visual relationships, and 2.8M attributes

Visual Relational Knowledge & Scene GraphsCC-BY-4.0108,077 images with 5.4M region descriptions, 2.3M visual relationships, and 2.8M attributesopen

Veri Profili ve Özellikler

Etiket Tipi:Scene graphs: localized bounding boxes, attributes, and directed relational predicate triples
Diller:en
Lisans Seviyesi:permissive-open-source
Modaliteler:image, text, graph

Amaçlanan Kullanım (Intended Use)

  • Sahne grafiği üretimi, görsel ilişki tespiti ve temellendirilmiş VQA kıyaslaması

Yasaklanan / Kaçınılması Gereken Kullanım

  • Yüz tanıma

Önyargı, Veri Sızıntısı ve Gizlilik Risk Analizi

Kişisel Veri Riskleri (Privacy Risks):

Kamuya açık ve özel alanlardaki insan etkinliklerini içeren fotoğraflar.

Bilinen Önyargılar (Known Bias):

Ağır görsel ilişki uzun kuyruğu ("on", "has", "wearing" baskındır).

Veri Sızıntısı Riski (Known Leakage):

MS COCO görüntü kimlikleriyle eşleştirilmiş temiz ayrım.

Uyumlu Araçlar ve Kütüphaneler