> ML_DATASET // OPEN-IMAGES-V7_v1.0
Open Images Dataset V7 (Google Research)
Google Research · Large-Scale Computer Vision · 9 million images with 16 million bounding boxes across 600 classes and localized narratives
Large-Scale Computer VisionCC-BY-4.0 (Annotations) / CC-BY-2.0 (Flickr Images)9 million images with 16 million bounding boxes across 600 classes and localized narrativesopen
Dataset Profile & Characteristics
Label Type:Image-level labels, bounding boxes, segmentation masks, localized narratives, visual relationships
Languages:en
License Tier:permissive-open-source
Modalities:image
Intended Use
- Large-scale object detection, instance segmentation, and visual relationship pre-training
Prohibited / Discouraged Use
- Biometric surveillance applications
Bias, Leakage & Privacy Risk Analysis
Privacy / Sensitive Data Risks:
Public Creative Commons Flickr images with people in diverse real-world scenes.
Known Bias:
Flickr photographer perspective; positive label verification bias.
Known Benchmark Leakage:
Standardized train, validation, and test splits vetted by Google.
