HumynLabs/Spanish_Documents_Dataset_PDF
Spanish Documents Dataset (PDF) This dataset contains a curated collection of Spanish-language documents in PDF format. It includes books, educational materials, research papers, news articles, and government publications written in Spanish. The dataset supports AI research in OCR, multilingual document understanding, and text extraction for Latin-script languages. Contact For queries or collaborations related to this dataset, contact: anoushka@kgen.io… See the full description on the dataset page: https://huggingface.co/datasets/HumynLabs/Spanish_Documents_Dataset_PDF.
0721
Update README.md
Upload 21 files
Update README.md
initial commit
