Team Ai
Datasetpublic

VDBBench/multimodal-embedding-10M

Multimodal Embedding 10M Benchmark Dataset A large-scale vector search benchmark dataset containing 10M base vectors and 10K query vectors with pre-computed ground truth (top-100 nearest neighbors by Inner Product), generated from multimodal (image + text) inputs. Dataset Summary Property Value Base Vectors 10,000,000 Query Vectors 10,000 Dimension 4,096 Distance Metric Inner Product (IP) Top-K Ground Truth 100 Vector dtype float32 Embedding… See the full description on the dataset page: https://huggingface.co/datasets/VDBBench/multimodal-embedding-10M.

sourceHugging Faceapache-2.0updated 6mo agoView on Hugging Face
0likes341downloads
3 commits on main
4275de96mo ago

Upload folder using huggingface_hub

WenxingZhu
cfaf4856mo ago

Upload README.md with huggingface_hub

WenxingZhu
dd5e5186mo ago

initial commit

WenxingZhu