Team Ai
Datasetpublic

mvp-lab/LLaVA-OneVision-2-Data

LLaVA-OneVision-2-Data Training data for the LLaVA-OneVision-2 multimodal model family. The release contains large-scale video data at several duration ranges, video captions and source mappings, and spatial-reasoning data used for mid-training. At a Glance The dataset is split across two Hugging Face repositories because of its size: Repository What it contains Part 1 (this repository) ~60-second video shards, captions for all duration ranges… See the full description on the dataset page: https://huggingface.co/datasets/mvp-lab/LLaVA-OneVision-2-Data.

sourceHugging Faceapache-2.0updated 1mo agoView on Hugging Face
42likes156kdownloads
50 commits on main
bf7038b1mo ago

Document Part 2 long-video data and citations

xiangan
59a87873mo ago

Add files using upload-large-folder tool

xiangan
e73747a5mo ago

Add files using upload-large-folder tool

xiangan
70849355mo ago

Add files using upload-large-folder tool

xiangan
a452deb5mo ago

Update README mapping path to mid_training_video/mapping/

xiangan
2d31a715mo ago

Remove old root-level mapping/ (moved to mid_training_video/mapping/)

xiangan
2ab776c5mo ago

Move mapping/ CSVs under mid_training_video/

xiangan
d4c9b945mo ago

Document mapping/ CSVs in README

xiangan
b77d21b5mo ago

Add mapping/ CSVs (dst_path -> youtube_id, start_time, end_time)

xiangan
14e34755mo ago

Expose 180s and gt10min viewer configs in README

xiangan
4509d455mo ago

Simplify spatial parquet schema to id+task+image+preview

xiangan
2e8a9075mo ago

Simplify caption parquet schema to video+preview only

xiangan
6c957775mo ago

Embed video bytes in caption parquet previews (30s/60s/180s/gt10min)

xiangan
280d00d5mo ago

Upload folder using huggingface_hub

xiangan
d9351ea5mo ago

Remove 180s and gt10min from README viewer configs

xiangan
278e8105mo ago

Upload folder using huggingface_hub

xiangan
50b12565mo ago

Upload folder using huggingface_hub

xiangan
99a75115mo ago

Simplify README and add 180s/gt10min viewer configs

xiangan
525bda95mo ago

Add gt10min caption preview parquet

xiangan
cab7a7a5mo ago

Add 180s caption preview parquet

xiangan
dfafd4b5mo ago

Upload folder using huggingface_hub

xiangan
08cd15b5mo ago

Add README with viewer configs and dataset documentation

xiangan
480fd765mo ago

Add Parquet preview samples for HF dataset viewer

xiangan
a763b955mo ago

Upload folder using huggingface_hub

xiangan
789da305mo ago

Upload folder using huggingface_hub

xiangan
e0b9cfb5mo ago

Upload folder using huggingface_hub

xiangan
b7365ef5mo ago

Add caption_v0 split jsonl files

xiangan
3a4a3e85mo ago

Upload folder using huggingface_hub

xiangan
fbf25b75mo ago

Upload folder using huggingface_hub

xiangan
c3e60795mo ago

Upload spatial/train_00000_of_00084.tar with huggingface_hub

xiangan
d2d46f96mo ago

Upload folder using huggingface_hub

xiangan
e1ebfe96mo ago

Upload folder using huggingface_hub

xiangan
802edad6mo ago

Upload folder using huggingface_hub

xiangan
6322f3e6mo ago

Upload folder using huggingface_hub

xiangan
1cc61fe6mo ago

Upload folder using huggingface_hub

xiangan
bfc2cf86mo ago

Upload folder using huggingface_hub

xiangan
44f269b6mo ago

Upload folder using huggingface_hub

xiangan
7e1bea06mo ago

Upload folder using huggingface_hub

xiangan
3a0a1ce6mo ago

Upload folder using huggingface_hub

xiangan
93cb96d6mo ago

Upload folder using huggingface_hub

xiangan
13b80bd6mo ago

Upload folder using huggingface_hub

xiangan
eac106c6mo ago

Upload folder using huggingface_hub

xiangan
60eed996mo ago

Upload folder using huggingface_hub

xiangan
38ec3346mo ago

Upload folder using huggingface_hub

xiangan
233475e6mo ago

Upload folder using huggingface_hub

xiangan
a50cfaa6mo ago

Upload folder using huggingface_hub

xiangan
54180d76mo ago

Upload folder using huggingface_hub

xiangan
84f2b566mo ago

Upload folder using huggingface_hub

xiangan
978d16c6mo ago

Upload folder using huggingface_hub

xiangan
c0e86aa6mo ago

Upload folder using huggingface_hub

xiangan
mvp-lab/LLaVA-OneVision-2-Data · Team Ai