Team Ai
Datasetpublic

p1atdev/ja-stackoverflow

ja-stackoverflow 日本語版 Stack Overflow の スタック・オーバーフロー のデータダンプ をもとにデータを加工し、質問文と回答文のペアになるように調整した QA データセット。 データ構造 投稿本文は html2text を使ってマークダウン化されています。その際、 コードブロックは ``` で囲まれるように変更されています。 画像 URL に base64 エンコードされた画像が含まれる場合、 [unk] に置き換えています。 default サブセット id: 質問投稿の ID question: 質問投稿 answers: 質問に対する回答投稿のリスト accepted_answer_id: 質問者に選ばれた回答のID。null の可能性がある popular_answer_id: もっともスコアが高かった回答のID。null の可能性がある simple サブセット default サブセットから、 question… See the full description on the dataset page: https://huggingface.co/datasets/p1atdev/ja-stackoverflow.

sourceHugging Facecc-by-sa-4.0updated 3y agoView on Hugging Face
8likes64downloads
.gitattributes56 linesDownload Raw Back to root
1*.7z filter=lfs diff=lfs merge=lfs -text2*.arrow filter=lfs diff=lfs merge=lfs -text3*.bin filter=lfs diff=lfs merge=lfs -text4*.bz2 filter=lfs diff=lfs merge=lfs -text5*.ckpt filter=lfs diff=lfs merge=lfs -text6*.ftz filter=lfs diff=lfs merge=lfs -text7*.gz filter=lfs diff=lfs merge=lfs -text8*.h5 filter=lfs diff=lfs merge=lfs -text9*.joblib filter=lfs diff=lfs merge=lfs -text10*.lfs.* filter=lfs diff=lfs merge=lfs -text11*.lz4 filter=lfs diff=lfs merge=lfs -text12*.mlmodel filter=lfs diff=lfs merge=lfs -text13*.model filter=lfs diff=lfs merge=lfs -text14*.msgpack filter=lfs diff=lfs merge=lfs -text15*.npy filter=lfs diff=lfs merge=lfs -text16*.npz filter=lfs diff=lfs merge=lfs -text17*.onnx filter=lfs diff=lfs merge=lfs -text18*.ot filter=lfs diff=lfs merge=lfs -text19*.parquet filter=lfs diff=lfs merge=lfs -text20*.pb filter=lfs diff=lfs merge=lfs -text21*.pickle filter=lfs diff=lfs merge=lfs -text22*.pkl filter=lfs diff=lfs merge=lfs -text23*.pt filter=lfs diff=lfs merge=lfs -text24*.pth filter=lfs diff=lfs merge=lfs -text25*.rar filter=lfs diff=lfs merge=lfs -text26*.safetensors filter=lfs diff=lfs merge=lfs -text27saved_model/**/* filter=lfs diff=lfs merge=lfs -text28*.tar.* filter=lfs diff=lfs merge=lfs -text29*.tar filter=lfs diff=lfs merge=lfs -text30*.tflite filter=lfs diff=lfs merge=lfs -text31*.tgz filter=lfs diff=lfs merge=lfs -text32*.wasm filter=lfs diff=lfs merge=lfs -text33*.xz filter=lfs diff=lfs merge=lfs -text34*.zip filter=lfs diff=lfs merge=lfs -text35*.zst filter=lfs diff=lfs merge=lfs -text36*tfevents* filter=lfs diff=lfs merge=lfs -text37# Audio files - uncompressed38*.pcm filter=lfs diff=lfs merge=lfs -text39*.sam filter=lfs diff=lfs merge=lfs -text40*.raw filter=lfs diff=lfs merge=lfs -text41# Audio files - compressed42*.aac filter=lfs diff=lfs merge=lfs -text43*.flac filter=lfs diff=lfs merge=lfs -text44*.mp3 filter=lfs diff=lfs merge=lfs -text45*.ogg filter=lfs diff=lfs merge=lfs -text46*.wav filter=lfs diff=lfs merge=lfs -text47# Image files - uncompressed48*.bmp filter=lfs diff=lfs merge=lfs -text49*.gif filter=lfs diff=lfs merge=lfs -text50*.png filter=lfs diff=lfs merge=lfs -text51*.tiff filter=lfs diff=lfs merge=lfs -text52# Image files - compressed53*.jpg filter=lfs diff=lfs merge=lfs -text54*.jpeg filter=lfs diff=lfs merge=lfs -text55*.webp filter=lfs diff=lfs merge=lfs -text56