llamaindex/vdr-multilingual-train download history
llamaindex/vdr-multilingual-train is a dataset on the Hugging Face Hub. In the last 30 days it was downloaded 1,406 times (547 in the last 7 days), and 47,828 times in total. It ranks #14,949 among datasets by monthly downloads.
Multilingual Visual Document Retrieval Dataset This dataset consists of 500k multilingual query image samples, collected and generated from scratch using public internet pdfs. The queries are synthetic and generated using VLMs (gemini-1.5-pro and Qwen2-VL-72B). It was used to train the
Models trained on vdr-multilingual-train
45 models list it as training data.
- athrael-soju/colqwen3.5-4.5B-v3 162.8K downloads in 30 days
- VAGOsolutions/SauerkrautLM-ColQwen3-2b-v0.1 40.6K downloads in 30 days
- tsystems/colqwen2.5-3b-multilingual-v1.0 27.1K downloads in 30 days
- webAI-Official/webAI-ColVec1.1-4b 1.6K downloads in 30 days
- Metric-AI/ColQwen2.5-3b-multilingual-v1.0 1.5K downloads in 30 days
- nomic-ai/colnomic-embed-multimodal-3b 1.3K downloads in 30 days
- nomic-ai/colnomic-embed-multimodal-7b 985 downloads in 30 days
- mradermacher/vdr-2b-multi-v1-i1-GGUF 799 downloads in 30 days
- llamaindex/vdr-2b-multi-v1 598 downloads in 30 days
- mradermacher/vdr-2b-multi-v1-GGUF 570 downloads in 30 days
- mradermacher/vdr-2b-v1-i1-GGUF 470 downloads in 30 days
- DataScience-UIBK/Argus-Colqwen3.5-4b-v0-bf16 409 downloads in 30 days