Team Ai
Datasetpublic

gorkemozer/docspider

DocSpider: a Dataset of Cross-Domain Natural Language Querying for MongoDB Arif Görkem Özer, Fırat Çekinel, Pınar Karagöz, İsmail Hakkı Toroslu You can access the paper published in Natural Language Processing journal, from this link. DocSpider dataset is generated by using the widely-known text-to-SQL dataset, Spider. See GitHub repository for more details, including benchmark pipeline scripts for text to MongoDB query conversion. Overview This… See the full description on the dataset page: https://huggingface.co/datasets/gorkemozer/docspider.

sourceHugging Facecc-by-4.0updated 1y agoView on Hugging Face
0likes54downloads
Dataset Card

DocSpider: a Dataset of Cross-Domain Natural Language Querying for MongoDB

Arif Görkem Özer, Fırat Çekinel, Pınar Karagöz, İsmail Hakkı Toroslu

You can access the paper published in Natural Language Processing journal, from this link.

DocSpider dataset is generated by using the widely-known text-to-SQL dataset, Spider.

See GitHub repository for more details, including benchmark pipeline scripts for text to MongoDB query conversion.

Overview

This repository contains a dataset, called DocSpider, for the task of converting natural language (English) to MongoDB querying language (MQL).