gorkemozer/docspider
DocSpider: a Dataset of Cross-Domain Natural Language Querying for MongoDB Arif Görkem Özer, Fırat Çekinel, Pınar Karagöz, İsmail Hakkı Toroslu You can access the paper published in Natural Language Processing journal, from this link. DocSpider dataset is generated by using the widely-known text-to-SQL dataset, Spider. See GitHub repository for more details, including benchmark pipeline scripts for text to MongoDB query conversion. Overview This… See the full description on the dataset page: https://huggingface.co/datasets/gorkemozer/docspider.
DocSpider: a Dataset of Cross-Domain Natural Language Querying for MongoDB
Arif Görkem Özer, Fırat Çekinel, Pınar Karagöz, İsmail Hakkı Toroslu
You can access the paper published in Natural Language Processing journal, from this link.
DocSpider dataset is generated by using the widely-known text-to-SQL dataset, Spider.
See GitHub repository for more details, including benchmark pipeline scripts for text to MongoDB query conversion.
Overview
This repository contains a dataset, called DocSpider, for the task of converting natural language (English) to MongoDB querying language (MQL).
