datasets
Training and evaluation data, with the modality, task and licence stated up front. Listed live from the Hugging Face Hub.
stablebridge-pruning-eval
Stablebridge Pruning Evaluation Dataset
Evaluation dataset for the Stablebridge context pruner/highlighter model, measuring sentence-level pruning quality on US stablecoin regulatory documents.
Dataset Structure
File
Records
Description
queries.jsonl
93
Regulatory queries (JSONL with _id and text fields)
corpus.jsonl
38
US stablecoin regulatory documents (full text)
qrels/test.tsv
2,704
Query-document relevance judgments
pruning_labels/test.jsonl
10,006… See the full description on the dataset page: https://huggingface.co/datasets/sugiv/stablebridge-pruning-eval.stablebridge-regulatory-retrieval-evalstablebridge-retrieval-eval
Stablebridge Retrieval Evaluation Dataset
Evaluation dataset for the Stablebridge regulatory intelligence retrieval system, measuring encoder quality on US stablecoin regulatory documents.
Dataset Structure
File
Records
Description
queries.jsonl
3,556
Regulatory queries (JSONL with _id and text fields)
corpus.jsonl
38
US stablecoin regulatory documents (full text)
qrels/test.tsv
14,294
Query-document relevance judgments (TSV: query_id, corpus_id, score)… See the full description on the dataset page: https://huggingface.co/datasets/sugiv/stablebridge-retrieval-eval.stablebridge-regulatory-pruning-eval
