Goader/kobza download history
Goader/kobza is a text generation dataset on the Hugging Face Hub. In the last 30 days it was downloaded 396 times (152 in the last 7 days), and 8,435 times in total. It ranks #39,722 among datasets by monthly downloads.
Kobza On the Path to Make Ukrainian a High-Resource Language [paper] Kobza is the largest publicly available Ukrainian corpus to date, comprising nearly 60 billion tokens across 97 million documents. It is designed to support pretraining and fine-tuning of large language models (LLMs) in Ukrainian
Models trained on kobza
9 models list it as training data.
- mradermacher/MamayLM-Gemma-3-12B-IT-v1.0-i1-GGUF 1.7K downloads in 30 days
- INSAIT-Institute/MamayLM-Gemma-3-4B-IT-v1.0 879 downloads in 30 days
- mradermacher/MamayLM-Gemma-3-4B-IT-v1.0-i1-GGUF 875 downloads in 30 days
- mradermacher/MamayLM-Gemma-3-12B-IT-v1.0-GGUF 832 downloads in 30 days
- mradermacher/MamayLM-Gemma-3-4B-IT-v1.0-GGUF 663 downloads in 30 days
- INSAIT-Institute/MamayLM-Gemma-3-12B-IT-v1.0 473 downloads in 30 days
- Goader/modern-liberta-large 155 downloads in 30 days
- lapa-llm/tokenizer 84 downloads in 30 days
- KoichiYasuoka/modernbert-base-ukrainian 13 downloads in 30 days