ヴォク

  • 説明

このデータセットには、分類および検出コンペティションに対応する PASCAL Visual Object Classes Challenge からのデータが含まれています。

分類コンテストの目標は、画像に含まれるラベルのセットを予測することですが、検出コンテストの目標は、個々のオブジェクトの境界ボックスとラベルを予測することです。警告: 公式データセットに従って、VOC2012 のテスト セットには注釈が含まれていません。

FeaturesDict({
    'image': Image(shape=(None, None, 3), dtype=uint8),
    'image/filename': Text(shape=(), dtype=string),
    'labels': Sequence(ClassLabel(shape=(), dtype=int64, num_classes=20)),
    'labels_no_difficult': Sequence(ClassLabel(shape=(), dtype=int64, num_classes=20)),
    'objects': Sequence({
        'bbox': BBoxFeature(shape=(4,), dtype=float32),
        'is_difficult': bool,
        'is_truncated': bool,
        'label': ClassLabel(shape=(), dtype=int64, num_classes=20),
        'pose': ClassLabel(shape=(), dtype=int64, num_classes=5),
    }),
})
  • 機能ドキュメント:
特徴クラスDタイプ説明
特徴辞書
画像画像(なし、なし、3) uint8
画像/ファイル名文章
ラベルシーケンス(クラスラベル) (なし、) int64
ラベルなし_難しいシーケンス(クラスラベル) (なし、) int64
オブジェクト順序
オブジェクト/BボックスBBox機能(4,) float32
オブジェクト/難しいテンソルブール
オブジェクト/is_truncatedテンソルブール
オブジェクト/ラベルクラスラベルint64
オブジェクト/ポーズクラスラベルint64

voc/2007 (デフォルト設定)

  • 構成の説明: このデータセットには、PASCAL Visual Object Classes Challenge 2007 (別名 VOC2007) のデータが含まれています。

このデータセットには合計 9963 枚の画像が含まれており、各画像には 20 の異なるクラスからの一連のオブジェクトが含まれており、合計 24640 個の注釈付きオブジェクトになります。

スプリット
'test' 4,952
'train' 2,501
'validation' 2,510

視覚化

  • 引用
@misc{pascal-voc-2007,
    author = "Everingham, M. and Van~Gool, L. and Williams, C. K. I. and Winn, J. and Zisserman, A.",
    title = "The {PASCAL} {V}isual {O}bject {C}lasses {C}hallenge 2007 {(VOC2007)} {R}esults",
    howpublished = "http://www.pascal-network.org/challenges/VOC/voc2007/workshop/index.html"}

ヴォク/2012

  • 構成の説明: このデータセットには、PASCAL Visual Object Classes Challenge 2012 (別名 VOC2012) のデータが含まれています。

このデータセットには合計 11,540 個の画像が含まれており、各画像には 20 の異なるクラスからのオブジェクトのセットが含まれており、合計 27,450 個の注釈付きオブジェクトになります。

スプリット
'test' 10,991
'train' 5,717
'validation' 5,823

視覚化

  • 引用
@misc{pascal-voc-2012,
    author = "Everingham, M. and Van~Gool, L. and Williams, C. K. I. and Winn, J. and Zisserman, A.",
    title = "The {PASCAL} {V}isual {O}bject {C}lasses {C}hallenge 2012 {(VOC2012)} {R}esults",
    howpublished = "http://www.pascal-network.org/challenges/VOC/voc2012/workshop/index.html"}