Team Ai
Datasetpublic

ifmain/comment-translation-01

This dataset is based on Kaggle. This dataset includes translations of 69,000 Reddit comments into 17 languages (English to 16 languages): Belarusian, Czech, German, English, Spanish, Finnish, French, Italian, Japanese, Kazakh, Korean, Latvian, Polish, Russian, Swedish, Ukrainian, and Chinese. It contains 50% regular comments and 50% highly negative ones. Enjoy using it!

sourceHugging Faceapache-2.0updated 2y agoView on Hugging Face
1likes70downloads
Dataset Card

This dataset is based on Kaggle.

This dataset includes translations of 69,000 Reddit comments into 17 languages (English to 16 languages): Belarusian, Czech, German, English, Spanish, Finnish, French, Italian, Japanese, Kazakh, Korean, Latvian, Polish, Russian, Swedish, Ukrainian, and Chinese.

It contains 50% regular comments and 50% highly negative ones. Enjoy using it!