lightonai/multilingual-embeddings-pre-training-curated download history

lightonai/multilingual-embeddings-pre-training-curated is a text retrieval dataset on the Hugging Face Hub. In the last 30 days it was downloaded 10,194 times (2,826 in the last 7 days), and 18,585 times in total. It ranks #2,967 among datasets by monthly downloads.

📚 Collection | 📝 Multilingual Blog | 📝 English Blog Contrastive Multilingual Pre-Training 2.16B query–document pairs across eight languages, plus cross-lingual pairs mDenseOn | mLateOn | DenseOn | LateOn | PyLate | FastPlaid 🎯 TL;DR: The multilingual contrastive pre-training corpus use

Spaces using multilingual-embeddings-pre-training-curated

Open lightonai/multilingual-embeddings-pre-training-curated on Hugging Face

Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.