Team Ai
Datasetpublic

HumynLabs/Russian_Documents_Dataset_PDF

Russian Documents Dataset (PDF) This dataset contains a curated collection of Russian-language documents in PDF format. The corpus includes books, academic papers, government publications, articles, and educational materials written in Russian. It is designed to support AI research in OCR, document understanding, and multilingual text recognition. Contact For queries or collaborations related to this dataset, contact: anoushka@kgen.io… See the full description on the dataset page: https://huggingface.co/datasets/HumynLabs/Russian_Documents_Dataset_PDF.

sourceHugging Facecc-by-4.0updated 11mo agoView on Hugging Face
1likes406downloads
4 commits on main
c75468711mo ago

Update README.md

KAI
4a0bb1c11mo ago

Upload 17 files

KAI
b37484811mo ago

Update README.md

KAI
c14790e11mo ago

initial commit

KAI