datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
CSS10-Multilingual-LJSpeech
CSS10-Multilingual-LJSpeech
Multilingual speech dataset combining LJSpeech (English) + CSS10 (10 languages) in a consistent LJSpeech format.
Dataset Description
This dataset merges:
LJSpeech: High-quality English speech dataset
CSS10: A collection of single-speaker speech datasets for 10 languages
All audio files are provided in a consistent format suitable for TTS training.
Features
Each sample contains:
audio: Waveform audio sampled at 22,050 Hz
text:… See the full description on the dataset page: https://huggingface.co/datasets/davidguzmanr/CSS10-Multilingual-LJSpeech.preprocessed_jsut_jsss_css10_common_voice_11
Dataset Card for "preprocessed_jsut_jsss_css10_common_voice_11"
More Information needed
preprocessed_jsut_jsss_css10_fleurs_common_voice_11
Dataset Card for "preprocessed_jsut_jsss_css10_fleurs_common_voice_11"
More Information needed
common_voice_large_jsut_jsss_css10
Dataset Card for vumichien/common_voice_large_jsut_jsss_css10
preprocessed_jsut_jsss_css10
Dataset Card for "preprocessed_jsut_jsss_css10"
More Information needed
css10-ljspeech
CSS10-LJSpeech
CSS10-LJSpeech は、Park et al. が公開した CSS10 データセットを、LJSpeech互換フォーマットに変換した10言語の音声合成用データセットです。各言語の文学作品を音声化した高品質な音声データを提供し、LJSpeechフォーマット(id|text & wavs/*.wav)に統一されています。
データ概要
項目
値
話者数
10 (言語別)
総音声数
64,196
合計時間
約 140 時間
サンプリングレート
22,050 Hz
音声フォーマット
IEEE浮動小数点 (32bit)
テキスト言語
10言語
フォーマット
`id
言語別統計
言語
言語コード
音声数
合計時間
ドイツ語
de
7,428
16.14時間
ギリシャ語
el
1,844
4.14時間
スペイン語
es
11,016
19.15時間
フィンランド語
fi
4,842
10.53時間… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/css10-ljspeech.css10-ljspeech-multilingual
CSS10 + LJSpeech Multilingual Dataset
A unified multilingual speech dataset combining CSS10 (10 languages) and LJSpeech (English) in a consistent LJSpeech format.
Dataset Description
This dataset merges:
CSS10: A collection of single-speaker speech datasets for 10 languages
LJSpeech: High-quality English speech dataset (Linda Johnson)
All audio files are provided in a consistent format suitable for TTS training.
Languages and Statistics
Language
Code… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/css10-ljspeech-multilingual.css10-ja-ljspeech
CSS100-LJSpeech (Japanese / Meian)
css100-ljspeech は、Park et al. が公開した CSS10 日本語コーパス(明暗)を、LJ Speech 互換フォーマット (id|text & wavs/*.wav) へ変換した派生データセットです。
データ概要
項目
値
話者
1 (ekzemplaro)
音声数
6,841
合計時間
約 15 時間
サンプリングレート
22,050 Hz
テキスト言語
日本語
フォーマット
``id
ファイル構成
css100-ljspeech/
├── metadata.csv # 2 列 (id|text)
└── wavs/
├── meian_0000.wav
├── meian_0001.wav
└── ...
使用例 (🤗 Datasets)
from datasets import load_dataset… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/css10-ja-ljspeech.css10-ja-ljspeech-audit
CSS10 Japanese LJSpeech — aggregate audit
This one-row audit describes ayousanz/css10-ja-ljspeech at revision
149edaf267ff8048c19ca8324fce07ea7423cd14. It excludes transcript text, utterance
IDs, audio paths, hashes, and audio payloads.
The metadata has 6,841 rows and exactly matches 6,841 ZIP audio members. There are two
empty-text rows, one language-review row, and 23 repeated-text groups. Bounded WAV-header
checks show 22.05 kHz mono 32-bit IEEE-float audio; size-derived… See the full description on the dataset page: https://huggingface.co/datasets/ayousanz/css10-ja-ljspeech-audit.
