Skip to main content

> ML_DATASET // OPEN-IMAGES-V7_v1.0

Open Images Dataset V7 (Google Research)

Google Research · Large-Scale Computer Vision · 9 million images with 16 million bounding boxes across 600 classes and localized narratives

Large-Scale Computer VisionCC-BY-4.0 (Annotations) / CC-BY-2.0 (Flickr Images)9 million images with 16 million bounding boxes across 600 classes and localized narrativesopen

Dataset Profile & Characteristics

Label Type:Image-level labels, bounding boxes, segmentation masks, localized narratives, visual relationships
Languages:en
License Tier:permissive-open-source
Modalities:image

Intended Use

  • Large-scale object detection, instance segmentation, and visual relationship pre-training

Prohibited / Discouraged Use

  • Biometric surveillance applications

Bias, Leakage & Privacy Risk Analysis

Privacy / Sensitive Data Risks:

Public Creative Commons Flickr images with people in diverse real-world scenes.

Known Bias:

Flickr photographer perspective; positive label verification bias.

Known Benchmark Leakage:

Standardized train, validation, and test splits vetted by Google.

Compatible Tools & Libraries