Team Ai
Datasetpublic

jugalgajjar/MultiLang-Code-Parser-Dataset

MultiLang Code Parser Dataset (MLCPD) MultiLang-Code-Parser-Dataset (MLCPD) provides a large-scale, unified dataset of parsed source code across 10 major programming languages, represented under a universal schema that captures syntax, semantics, and structure in a consistent format. Each entry corresponds to one parsed source file and includes: Language metadata Code-level statistics (lines, errors, AST nodes) Universal Schema JSON (normalized structural representation)… See the full description on the dataset page: https://huggingface.co/datasets/jugalgajjar/MultiLang-Code-Parser-Dataset.

sourceHugging Facemitupdated 1y agoView on Hugging Face
2likes300downloads
settings

This repository belongs to jugalgajjar on Hugging Face.

Team Ai never edits a repository it does not host. Visibility, licence, collaborators and gating are all managed at the source.

nameMultiLang-Code-Parser-Dataset
visibilitypublic
licencemit
gatedno
ownerjugalgajjar
Account settings
jugalgajjar/MultiLang-Code-Parser-Dataset · Team Ai