DINOv3: Label-Free Vision Pretraining on 1.7 Billion Images

Meta trained DINOv3’s largest vision backbone on 1.689 billion images without labels or captions, then reused its frozen features for detection, segmentation, and satellite mapping.
artificial-intelligence
data-science
Author

Kabui, Charles

Published

2026-07-23

Keywords

dinov3, computer-vision, self-supervised-learning, vision-foundation-model, satellite-imagery