arka0821/multi_document_summarization
Multi-Document, a large-scale multi-document summarization dataset created from scientific articles. Multi-Document introduces a challenging multi-document summarization task: writing the related-work section of a paper based on its abstract and the articles it references.
598
1{2 "default":{3 "description":"\nMulti-Document,a large-scale multi-document summarization dataset created from scientific articles. Multi-Document introduces a challenging multi-document summarization task: writing therelated-work section of a paper based on itsabstract and the articles it references.\n",4 "citation":"\n@article{lu2020multi,\n title={Multi-Document: A Large-scale Dataset for Extreme Multi-document Summarization of Scientific Articles},\n author={Arka Das, India},\n journal={arXiv preprint arXiv:2010.14235},\n year={2022}\n}\n",5 "homepage":"https://github.com/arka0821/multi_document_summarization",6 "license":"",7 "features":{8 "id":{9 "dtype":"string",10 "id":null,11 "_type":"Value"12 },13 "docs":{14 "feature":{15 "id":{16 "dtype":"string",17 "id":null,18 "_type":"Value"19 },20 "text":{21 "dtype":"string",22 "id":null,23 "_type":"Value"24 }25 },26 "length":-1,27 "id":null,28 "_type":"Sequence"29 },30 "summary":{31 "dtype":"string",32 "id":null,33 "_type":"Value"34 }35 },36 "post_processed":null,37 "supervised_keys":null,38 "builder_name":"multi_document_summarization",39 "config_name":"default",40 "version":{41 "version_str":"1.1.0",42 "description":null,43 "major":1,44 "minor":1,45 "patch":046 },47 "splits":{48 "train":{49 "name":"train",50 "dataset_name":"multi_document_summarization"51 },52 "test":{53 "name":"test",54 "dataset_name":"multi_document_summarization"55 },56 "validation":{57 "name":"validation",58 "dataset_name":"multi_document_summarization"59 }60 },61 "post_processing_size":null62 }63}