datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
DiSH-Bench-static-v2
DiSH-Bench static v2 — test release
A simulated multi-receiver spatial speech benchmark, with aligned single-receiver
and multi-receiver questions over the same physical scenes. This release contains
122,256 test questions, 2,000 physical scenes, 4,400 original four-channel FOA
recordings, and 200 rooms. There are 58,829 single-input questions, 53,518
two-input questions and 9,909 three-input questions. Questions share recordings;
they are not independent acoustic scenes.
Source… See the full description on the dataset page: https://huggingface.co/datasets/Heiheihaha17/DiSH-Bench-static-v2.static30s_audio_train_static_at_micstatic-pink-trombone-1s30s_audio_train_static_at_wallstatic_train_28800_32400static_train36000static_1.1_train_6720_7560static_1.1_train_7560_8400static_train_10800_14400static_train_14400_18000static_train_25200_28800static_train_32400_36000static_1.1_train_2520_3360static_1.1_train_4200_5040static_1.2_short_dist_train_2520_3360static_1.2_short_dist_train_3360_4200static_1.2_short_dist_train_5040_5880static_1.1_AtMic_validationstatic_train_0_3600static_train_3600_7200static_train_7200_10800static_train_18000_21600static_1.1_train_0_840static_1.1_train_840_1680static_1.1_train_1680_2520static_1.1_train_3360_4200static_1.1_train_5040_5880static_1.1_train_5880_6720static_1.2_short_dist_train_0_840
