OmniEvalKit/omnievalkit-dataset
OmniEvalKit Evaluation Datasets Evaluation datasets for OmniEvalKit, a comprehensive evaluation framework for omni-modal (audio + video + image + text) models. Overview Total subsets: 65 Total samples: 315,264 Total size: 620.3 GB (Parquet with embedded audio/image/video) Subsets with embedded video: 15 Subsets requiring external video download: 2 Usage from datasets import load_dataset ds = load_dataset("OmniEvalKit/omnievalkit-dataset"… See the full description on the dataset page: https://huggingface.co/datasets/OmniEvalKit/omnievalkit-dataset.
OmniEvalKit Evaluation Datasets
Evaluation datasets for OmniEvalKit, a comprehensive evaluation framework for omni-modal (audio + video + image + text) models.
Overview
- Total subsets: 65
- Total samples: 315,264
- Total size: 620.3 GB (Parquet with embedded audio/image/video)
- Subsets with embedded video: 15
- Subsets requiring external video download: 2
Usage
from datasets import load_dataset
ds = load_dataset("OmniEvalKit/omnievalkit-dataset", "aishell1_test")
for sample in ds["test"]:
print(sample)Available Subsets
Audio (44 subsets, 267,616 samples, 186.5GB)
Omni (20 subsets, 46,648 samples, 432.1GB)
Unknown (1 subsets, 1,000 samples, 1.7GB)
Data Format
Each subset is stored as Parquet file(s):
- Metadata fields: All original JSONL fields (question, answer, paths, etc.)
- `audio`: HuggingFace
Audiotype —struct<bytes: binary, path: string>, playable in Dataset Viewer - `image`: HuggingFace
Imagetype —struct<bytes: binary, path: string>, viewable in Dataset Viewer - `video`: Video binary —
struct<bytes: binary, path: string>, embedded for applicable subsets - `audio_bytes_dict`: Multiple audio files as base64-encoded JSON string
- `image_bytes_dict`: Multiple image files as base64-encoded JSON string
License
Apache 2.0. Individual datasets may have their own licenses.
