Team Ai
Datasetpublic

thomasyyj/LongBioBench_Sample

A Controllable Examination for Long-Context Language Models This is a sample dataset created using Qwen-7B tokenizer. For details, please check our paper This dataset is created by running from our repo bash scripts/submit_scripts/prepare_data.sh

sourceHugging Faceapache-2.0updated 1y agoView on Hugging Face
0likes129downloads
Dataset Card

A Controllable Examination for Long-Context Language Models

This is a sample dataset created using Qwen-7B tokenizer. For details, please check our paper

This dataset is created by running from our repo

bash scripts/submit_scripts/prepare_data.sh