ESpeech/ESpeech-webinars2
Webinar Audio Dataset Dataset Description This dataset contains 850 hours processed webinar audio segments with corresponding metadata. Each audio file represents a segment extracted from webinar recordings, processed at 44.1kHz sample rate. Dataset Summary Language: Russian Task: TTS, ASR, Quality Asessment Audio format: MP3, 44.1kHz sample rate Structure: Segmented audio files with JSON metadata Dataset Structure Data… See the full description on the dataset page: https://huggingface.co/datasets/ESpeech/ESpeech-webinars2.
Update README.md
Update README.md
Format changed
Delete webinars.zip
Delete webinars.z03
Delete webinars.z02
Delete webinars.z01
Upload mos.png
Update README.md
Update README.md
Create README.md
Upload folder using huggingface_hub
initial commit
