pruhtopia/multilingual-bert-toc-95k-dataset
Dataset Details Dataset Description Contains line-by-line sequences from human-annotated legal/government documents and their corresponding labels. Line-by-line examples derived from DocLayNet dataset Dataset Creation Notebook displaying how dataset was created can be accessed here
010
