Team Ai
Datasetpublic

AmazonScience/MultilingualMultiModalClassification

Additional Information To load the dataset, import datasets ds = datasets.load_dataset("AmazonScience/MultilingualMultiModalClassification", data_dir="wiki-doc-ar-merged") print(ds) DatasetDict({ train: Dataset({ features: ['image', 'filename', 'words', 'ocr_bboxes', 'label'], num_rows: 8129 }) validation: Dataset({ features: ['image', 'filename', 'words', 'ocr_bboxes', 'label'], num_rows: 1742 }) test: Dataset({… See the full description on the dataset page: https://huggingface.co/datasets/AmazonScience/MultilingualMultiModalClassification.

sourceHugging Facecc-by-4.0updated 2y agoView on Hugging Face
2likes60kdownloads
../
filetest-00000-of-00002.parquet804.0 MBdownload
filetest-00001-of-00002.parquet796.8 MBdownload
filetrain-00000-of-00009.parquet838.0 MBdownload
filetrain-00001-of-00009.parquet832.7 MBdownload
filetrain-00002-of-00009.parquet824.1 MBdownload
filetrain-00003-of-00009.parquet842.7 MBdownload
filetrain-00004-of-00009.parquet853.6 MBdownload
filetrain-00005-of-00009.parquet837.6 MBdownload
filetrain-00006-of-00009.parquet828.4 MBdownload
filetrain-00007-of-00009.parquet832.9 MBdownload
filetrain-00008-of-00009.parquet805.1 MBdownload
filevalidation-00000-of-00002.parquet803.6 MBdownload
filevalidation-00001-of-00002.parquet806.6 MBdownload

AmazonScience/MultilingualMultiModalClassification · main · files are served by the source, never re-hosted here