MaLA-LM/mala-monolingual-split download history
MaLA-LM/mala-monolingual-split is a text generation dataset on the Hugging Face Hub. In the last 30 days it was downloaded 2,795 times (429 in the last 7 days), and 54,932 times in total. It ranks #8,835 among datasets by monthly downloads.
MaLA Corpus: Massive Language Adaptation Corpus This version contains train and validation splits. Dataset Summary The MaLA Corpus (Massive Language Adaptation) is a comprehensive, multilingual dataset designed to support the continual pre-training of large language mod
Models trained on mala-monolingual-split
10 models list it as training data.
- bartowski/emma-500-llama2-7b-GGUF 3.7K downloads in 30 days
- QuantFactory/emma-500-llama2-7b-GGUF 565 downloads in 30 days
- mradermacher/emma-500-llama2-7b-GGUF 395 downloads in 30 days
- MaLA-LM/emma-500-llama3-8b-bi 228 downloads in 30 days
- MaLA-LM/emma-500-llama2-7b 122 downloads in 30 days
- MaLA-LM/emma-500-llama3.1-8b-bi 110 downloads in 30 days
- tensorblock/emma-500-llama2-7b-GGUF 101 downloads in 30 days
- MaLA-LM/emma-500-llama3.1-8b-mono 81 downloads in 30 days
- MaLA-LM/emma-500-llama3-8b-mono 18 downloads in 30 days
- wyrmiyu/emma-500-llama3.1-8b-bi-Q8_0-GGUF 12 downloads in 30 days
Open MaLA-LM/mala-monolingual-split on Hugging Face
Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.