ai4bharat/sangraha download history
ai4bharat/sangraha is a text generation dataset on the Hugging Face Hub. In the last 30 days it was downloaded 46,592 times (9,940 in the last 7 days), and 375,157 times in total. It ranks #535 among datasets by monthly downloads.
Sangraha Sangraha is the largest high-quality, cleaned Indic language pretraining data containing 251B tokens summed up over 22 languages, extracted from curated sources, existing multilingual corpora and large scale translations. More information: For detailed information on the c
Models trained on sangraha
33 models list it as training data.
- ai4bharat/Cadence-Fast 6.3K downloads in 30 days
- ai4bharat/Cadence 3.6K downloads in 30 days
- mradermacher/shivneri-marathi-llm-7b-v0.1-i1-GGUF 932 downloads in 30 days
- soketlabs/pragna-1b 707 downloads in 30 days
- mradermacher/Marathi-SmolLM2-145M-GGUF 703 downloads in 30 days
- ai4bharat/IndicBERT-v3-270M 618 downloads in 30 days
- sraivante/Sanskrit-322M-Base 459 downloads in 30 days
- samvaran/chandohasam 284 downloads in 30 days
- sky-2002/Marathi-SmolLM2-145M 275 downloads in 30 days
- mradermacher/shivneri-marathi-llm-7b-v0.1-GGUF 225 downloads in 30 days
- tensorblock/shivneri-marathi-llm-7b-v0.1-GGUF 197 downloads in 30 days
- ai4bharat/IndicBERT-v3-4B 182 downloads in 30 days
Spaces using sangraha
- Model Pulse 8 likes