AmazonScience/MultilingualMultiModalClassification
Additional Information To load the dataset, import datasets ds = datasets.load_dataset("AmazonScience/MultilingualMultiModalClassification", data_dir="wiki-doc-ar-merged") print(ds) DatasetDict({ train: Dataset({ features: ['image', 'filename', 'words', 'ocr_bboxes', 'label'], num_rows: 8129 }) validation: Dataset({ features: ['image', 'filename', 'words', 'ocr_bboxes', 'label'], num_rows: 1742 }) test: Dataset({… See the full description on the dataset page: https://huggingface.co/datasets/AmazonScience/MultilingualMultiModalClassification.
260k
../
test-00000-of-00002.parquetdownload
test-00001-of-00002.parquetdownload
train-00000-of-00009.parquetdownload
train-00001-of-00009.parquetdownload
train-00002-of-00009.parquetdownload
train-00003-of-00009.parquetdownload
train-00004-of-00009.parquetdownload
train-00005-of-00009.parquetdownload
train-00006-of-00009.parquetdownload
train-00007-of-00009.parquetdownload
train-00008-of-00009.parquetdownload
validation-00000-of-00002.parquetdownload
validation-00001-of-00002.parquetdownload
