castorini/wura download history
castorini/wura is a text generation dataset on the Hugging Face Hub. In the last 30 days it was downloaded 683 times (220 in the last 7 days), and 27,094 times in total. It ranks #25,872 among datasets by monthly downloads.
Dataset Summary WURA is a document-level dataset covering 16 African Languages and 4 high-resource languages widely spoken in Africa (English, French, Arabic and Portuguese). This dataset was created by auditing mC4 and crawling additional verified news sources. It was first used to train
Models trained on wura
12 models list it as training data.
- castorini/afriteva_v2_base 2.7K downloads in 30 days
- vamboai/morena-1.5b-instruct-gguf 319 downloads in 30 days
- vamboai/morena-1.5b-instruct 291 downloads in 30 days
- castorini/afriteva_v2_large 221 downloads in 30 days
- vamboai/morena-0.5b-mini-gguf 144 downloads in 30 days
- vamboai/morena-0.2b-nano-gguf 112 downloads in 30 days
- vamboai/morena-1.5b-base 82 downloads in 30 days
- vamboai/morena-0.5b-mini 43 downloads in 30 days
- vamboai/morena-0.5b-mini-instruct 41 downloads in 30 days
- olaverse/mist-encoder-base-ng 27 downloads in 30 days
- vamboai/morena-0.2b-nano 27 downloads in 30 days
- yonas/AmhT5-tokenizer – downloads in 30 days