lightonai/multilingual-embeddings-pre-training-curated download history
lightonai/multilingual-embeddings-pre-training-curated is a text retrieval dataset on the Hugging Face Hub. In the last 30 days it was downloaded 10,194 times (2,826 in the last 7 days), and 18,585 times in total. It ranks #2,967 among datasets by monthly downloads.
📚 Collection | 📝 Multilingual Blog | 📝 English Blog Contrastive Multilingual Pre-Training 2.16B query–document pairs across eight languages, plus cross-lingual pairs mDenseOn | mLateOn | DenseOn | LateOn | PyLate | FastPlaid 🎯 TL;DR: The multilingual contrastive pre-training corpus use
Spaces using multilingual-embeddings-pre-training-curated
- Model Pulse 8 likes
Open lightonai/multilingual-embeddings-pre-training-curated on Hugging Face
Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.