- 説明:
このデータセットには、分類と検出のコンテストに対応する PASCAL Visual Object Classes Challenge のデータが含まれています。
分類コンペティションの目標は、画像に含まれる一連のラベルを予測することですが、検出コンペティションの目標は、個々のオブジェクトの境界ボックスとラベルを予測することです。警告: 公式データセットによると、VOC2012 のテスト セットには注釈が含まれていません。
追加のドキュメント:コード を使用したペーパーの探索
ソース コード:
tfds.object_detection.Voc
バージョン:
-
4.0.0
(デフォルト): リリース ノートはありません。
-
自動キャッシュ(ドキュメント): いいえ
機能構造:
FeaturesDict({
'image': Image(shape=(None, None, 3), dtype=uint8),
'image/filename': Text(shape=(), dtype=string),
'labels': Sequence(ClassLabel(shape=(), dtype=int64, num_classes=20)),
'labels_no_difficult': Sequence(ClassLabel(shape=(), dtype=int64, num_classes=20)),
'objects': Sequence({
'bbox': BBoxFeature(shape=(4,), dtype=float32),
'is_difficult': bool,
'is_truncated': bool,
'label': ClassLabel(shape=(), dtype=int64, num_classes=20),
'pose': ClassLabel(shape=(), dtype=int64, num_classes=5),
}),
})
- 機能のドキュメント:
特徴 | クラス | 形 | Dtype | 説明 |
---|---|---|---|---|
特徴辞書 | ||||
画像 | 画像 | (なし、なし、3) | uint8 | |
画像/ファイル名 | 文章 | ストリング | ||
ラベル | シーケンス(クラスラベル) | (なし、) | int64 | |
labels_no_difficult | シーケンス(クラスラベル) | (なし、) | int64 | |
オブジェクト | 順序 | |||
オブジェクト/bbox | BBoxFeature | (4) | float32 | |
オブジェクト/難しいです | テンソル | ブール | ||
オブジェクト/is_truncated | テンソル | ブール | ||
オブジェクト/ラベル | クラスラベル | int64 | ||
オブジェクト/ポーズ | クラスラベル | int64 |
- 監視されたキー(
as_supervised
docを参照):None
voc/2007 (デフォルト構成)
- 構成の説明: このデータセットには、PASCAL Visual Object Classes Challenge 2007、別名 VOC2007 のデータが含まれています。
このデータセットには合計 9963 枚の画像が含まれており、各画像には 20 個の異なるクラスからの一連のオブジェクトが含まれており、合計 24640 個の注釈付きオブジェクトが作成されています。
ダウンロードサイズ:
868.85 MiB
データセットのサイズ:
837.73 MiB
スプリット:
スプリット | 例 |
---|---|
'test' | 4,952 |
'train' | 2,501 |
'validation' | 2,510 |
- 図( tfds.show_examples ):
- 例( tfds.as_dataframe ):
- 引用:
@misc{pascal-voc-2007,
author = "Everingham, M. and Van~Gool, L. and Williams, C. K. I. and Winn, J. and Zisserman, A.",
title = "The {PASCAL} {V}isual {O}bject {C}lasses {C}hallenge 2007 {(VOC2007)} {R}esults",
howpublished = "http://www.pascal-network.org/challenges/VOC/voc2007/workshop/index.html"}
voc/2012
- 構成の説明: このデータセットには、PASCAL Visual Object Classes Challenge 2012、別名 VOC2012 のデータが含まれています。
このデータセットには合計 11540 枚の画像が含まれており、各画像には 20 個の異なるクラスからの一連のオブジェクトが含まれており、合計 27450 個の注釈付きオブジェクトが作成されています。
ダウンロードサイズ:
3.59 GiB
データセットサイズ:
2.44 GiB
スプリット:
スプリット | 例 |
---|---|
'test' | 10,991 |
'train' | 5,717 |
'validation' | 5,823 |
- 図( tfds.show_examples ):
- 例( tfds.as_dataframe ):
- 引用:
@misc{pascal-voc-2012,
author = "Everingham, M. and Van~Gool, L. and Williams, C. K. I. and Winn, J. and Zisserman, A.",
title = "The {PASCAL} {V}isual {O}bject {C}lasses {C}hallenge 2012 {(VOC2012)} {R}esults",
howpublished = "http://www.pascal-network.org/challenges/VOC/voc2012/workshop/index.html"}