Team Ai
Datasetpublic

kanhatakeyama/CreativeCommons-RAG-QA-Mixtral8x22b

以下のデータ源からランダムに抽出した日本語のテキストをもとに、RAG形式のQ&Aを自動生成したものです。 Wikibooks Wikipedia 判例データ instruction datasetとしてではなく、事前学習での利用を想定しています(質疑応答をするための訓練)。 一部の計算には東京工業大学のスーパーコンピュータTSUBAME4.0を利用しました。

sourceHugging Facecc-by-sa-3.0updated 2y agoView on Hugging Face
0likes7downloads
Dataset Card
  • —以下のデータ源からランダムに抽出した日本語のテキストをもとに、RAG形式のQ&Aを自動生成したものです。
  • —
  • —Wikibooks
  • —Wikipedia
  • —判例データ
  • —instruction datasetとしてではなく、事前学習での利用を想定しています(質疑応答をするための訓練)。
  • —一部の計算には東京工業大学のスーパーコンピュータTSUBAME4.0を利用しました。