资源库
Vision Datasets
面向图像分类、检测、分割与视觉理解的公开数据集。
ADE20K
MIT CSAIL
面向场景解析与语义分割的大规模标注图像数据集。
segmentationscene-parsing
Vision
CIFAR-10
University of Toronto
包含 10 类小尺寸彩色图像的经典图像分类数据集。
classificationbenchmark
Vision
CIFAR-100
University of Toronto
包含 100 类小尺寸彩色图像的经典图像分类数据集。
classificationbenchmark
Vision
Cityscapes
Cityscapes
面向自动驾驶场景理解的城市街景语义分割数据集。
segmentationautonomous-driving
Vision
COCO
COCO Consortium
面向目标检测、分割与图像描述的大规模视觉数据集。
object-detectionsegmentationcaptioning
Vision
Fashion-MNIST
Zalando Research
以服饰图像替代手写数字的图像分类基准数据集。
classificationbenchmark
Vision
ImageNet
ImageNet
大规模图像分类基准数据集,广泛用于视觉模型训练与评测。
classificationbenchmark
Vision
LAION-5B
LAION
包含数十亿图文对的开放数据集,广泛用于多模态与视觉表示学习。
image-textpretraining
Vision
LVIS
Facebook AI Research
面向长尾类别目标检测与实例分割的大规模视觉数据集。
object-detectioninstance-segmentation
Vision
MNIST
NYU / Yann LeCun
手写数字识别的经典基准数据集。
classificationbenchmark
Vision
Open Images
Google 发布的大规模带标注图像数据集,覆盖检测、分割与关系标注。
object-detectionsegmentation
Vision
PASCAL VOC
University of Oxford
面向目标检测与语义分割的经典视觉挑战数据集。
object-detectionsegmentation
Vision
Visual Genome
University of Washington
带有物体、属性和关系标注的视觉场景理解数据集。
scene-graphvisual-reasoning
Vision