Team Ai
Datasetpublic

pruhtopia/multilingual-bert-toc-95k-dataset

Dataset Details Dataset Description Contains line-by-line sequences from human-annotated legal/government documents and their corresponding labels. Line-by-line examples derived from DocLayNet dataset Dataset Creation Notebook displaying how dataset was created can be accessed here

sourceHugging Faceapache-2.0updated 3y agoView on Hugging Face
0likes10downloads
Dataset Card

Dataset Details

Dataset Description

Contains line-by-line sequences from human-annotated legal/government documents and their corresponding labels. Line-by-line examples derived from DocLayNet dataset

Dataset Creation

Notebook displaying how dataset was created can be accessed here