Senqiao/VisionThink-Smart-Train
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning Senqiao/VisionThink-Smart-Train This is the training dataset used for our Efficient Reasoning VLM on general VQA tasks. VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning [Paper] Senqiao Yang, Junyi Li, Xin Lai, Bei Yu, Hengshuang Zhao, Jiaya Jia Highlights Our VisionThink leverages reinforcement learning to autonomously… See the full description on the dataset page: https://huggingface.co/datasets/Senqiao/VisionThink-Smart-Train.
11.4k
data-00000-of-00021.arrowdownload
data-00001-of-00021.arrowdownload
data-00002-of-00021.arrowdownload
data-00003-of-00021.arrowdownload
data-00004-of-00021.arrowdownload
data-00005-of-00021.arrowdownload
data-00006-of-00021.arrowdownload
data-00007-of-00021.arrowdownload
data-00008-of-00021.arrowdownload
data-00009-of-00021.arrowdownload
data-00010-of-00021.arrowdownload
data-00011-of-00021.arrowdownload
data-00012-of-00021.arrowdownload
data-00013-of-00021.arrowdownload
data-00014-of-00021.arrowdownload
data-00015-of-00021.arrowdownload
data-00016-of-00021.arrowdownload
data-00017-of-00021.arrowdownload
data-00018-of-00021.arrowdownload
data-00019-of-00021.arrowdownload
data-00020-of-00021.arrowdownload
