Team Ai
30 shown

datasets

Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.

Clear all
01willcai /wav2vec2_common_voice_accents_3tabular100K<n<1M0 likes2.1k downloads5y agoHugging Face02mosama /sada-train-wav2vec2-xls-r-300m-ar-preprocessedaudio100K<n<1M0 likes493 downloads1y agoHugging Face03elisabethvonoswald /wav2vec2-large-xls-r-300m-750-100-onelabeltimeseries1K<n<10K0 likes328 downloads4y agoHugging Face04speako /wav2vec2-test-datasetaudio10K<n<100K0 likes222 downloads1y agoHugging Face05UrukHan /wav2vec2-ru-IIItabular10K<n<100K0 likes217 downloads4y agoHugging Face06Hunzla /simplified_google_speech_commands_wav2vec2_960haudio10K<n<100K1 likes206 downloads3y agoHugging Face07Taeham /wav2vec2-ksponspeech-train2text10K<n<100K0 likes176 downloads4y agoHugging Face08DavidCombei /Wav2Vec2_ASVSpoof5_FULLaudio100K<n<1M1 likes172 downloads2y agoHugging Face09cairocode /MSPP_WAV2Vec2image100K<n<1M0 likes165 downloads2y agoHugging Face10willcai /wav2vec2_common_voice_accentstimeseries10K<n<100K1 likes163 downloads5y agoHugging Face11cairocode /MSPP_Wav2Vec2_V2image100K<n<1M0 likes161 downloads2y agoHugging Face12mohamed-illiyas /wav2vec2-base-lj-demo-colabtimeseries10K<n<100K0 likes156 downloads5y agoHugging Face13Wiedy /wav2vec2-large-xls-r-300m-tr-colab0 likes129 downloads5y agoHugging Face14Chijioke-Mgbahurike /wav2vec2_basespot_data_allaudio1K<n<10K0 likes119 downloads2y agoHugging Face15UrukHan /wav2vec2-ru-IItabular10K<n<100K1 likes114 downloads4y agoHugging Face16Hunzla /simplified-google-speech-commands-wav2vec2-960haudio10K<n<100K0 likes108 downloads3y agoHugging Face17UrukHan /wav2vec2-ru-IVtabular10K<n<100K0 likes86 downloads4y agoHugging Face18UrukHan /wav2vec2-russian0 likes74 downloads5y agoHugging Face19csdhbg /PMEmo2019-audio-wav2vec2-processed-valence-traintextn<1K0 likes71 downloads1y agoHugging Face20Chijioke-Mgbahurike /wav2vec2_phoneme_spot_data_allaudio1K<n<10K0 likes67 downloads2y agoHugging Face21Splend1dchan /NMSQA_features_wav2vec2-large-lv600 likes66 downloads4y agoHugging Face22greenarcade /wav2vec2-vd-bird-sound-classification-datasetaudioaudio-classification1K<n<10K3 likes60 downloads1y agoHugging Face23Taeham /wav2vec2-ksponspeech-traintext10K<n<100K0 likes52 downloads4y agoHugging Face24Bisher /processed-LA-Wav2Vec2timeseries100K<n<1M0 likes49 downloads2y agoHugging Face25csdhbg /PMEmo2019-audio-wav2vec2-processed-valence-new-regressor-train-datasettextn<1K0 likes48 downloads1y agoHugging Face26UrukHan /wav2vec2-ru-Itabular10K<n<100K0 likes47 downloads4y agoHugging Face27sjhuskey /enenlhet-wav2vec2-dataset Enenlhet Wav2Vec2 Dataset This dataset contains preprocessed audio features and tokenized text for training Wav2Vec2 models on the Enenlhet language. Dataset Summary Train: 3,053 examples Test: 170 examples Validation: 170 examples Total: 3,393 examples Features input_values: Preprocessed audio features (16kHz, normalized float32 arrays) labels: Tokenized text as integer sequences Usage from datasets import load_dataset # Load the dataset… See the full description on the dataset page: https://huggingface.co/datasets/sjhuskey/enenlhet-wav2vec2-dataset.timeseriesautomatic-speech-recognition1K<n<10K0 likes47 downloads1y agoHugging Face28mosama /sada-validation-wav2vec2-xls-r-300m-ar-preprocessedaudio1K<n<10K0 likes46 downloads1y agoHugging Face29Chijioke-Mgbahurike /wav2vec2_processed_spotify-nonstratifiedtimeseries1K<n<10K0 likes45 downloads2y agoHugging Face30danielroncel /dstc2_audios_input_wav2vec2text10K<n<100K0 likes43 downloads3y agoHugging Face

Listings come live from the Hugging Face Hub API. Team Ai does not host these files.