Team Ai
Datasetpublic

arka0821/multi_document_summarization

Multi-Document, a large-scale multi-document summarization dataset created from scientific articles. Multi-Document introduces a challenging multi-document summarization task: writing the related-work section of a paper based on its abstract and the articles it references.

sourceHugging Faceunknownupdated 4y agoView on Hugging Face
5likes98downloads
dataset_infos.json63 linesDownload Raw Back to root
1{2   "default":{3      "description":"\nMulti-Document,a large-scale multi-document summarization dataset created from scientific articles. Multi-Document introduces a challenging multi-document summarization task: writing therelated-work section of a paper based on itsabstract and the articles it references.\n",4      "citation":"\n@article{lu2020multi,\n  title={Multi-Document: A Large-scale Dataset for Extreme Multi-document Summarization of Scientific Articles},\n  author={Arka Das, India},\n  journal={arXiv preprint arXiv:2010.14235},\n  year={2022}\n}\n",5      "homepage":"https://github.com/arka0821/multi_document_summarization",6      "license":"",7      "features":{8         "id":{9            "dtype":"string",10            "id":null,11            "_type":"Value"12         },13         "docs":{14            "feature":{15               "id":{16                  "dtype":"string",17                  "id":null,18                  "_type":"Value"19               },20               "text":{21                  "dtype":"string",22                  "id":null,23                  "_type":"Value"24               }25            },26            "length":-1,27            "id":null,28            "_type":"Sequence"29         },30		 "summary":{31            "dtype":"string",32            "id":null,33            "_type":"Value"34         }35      },36      "post_processed":null,37      "supervised_keys":null,38      "builder_name":"multi_document_summarization",39      "config_name":"default",40      "version":{41         "version_str":"1.1.0",42         "description":null,43         "major":1,44         "minor":1,45         "patch":046      },47      "splits":{48         "train":{49            "name":"train",50            "dataset_name":"multi_document_summarization"51         },52         "test":{53            "name":"test",54            "dataset_name":"multi_document_summarization"55         },56         "validation":{57            "name":"validation",58            "dataset_name":"multi_document_summarization"59         }60      },61      "post_processing_size":null62   }63}