ai4bharat/samanantar download history
ai4bharat/samanantar is a text generation dataset on the Hugging Face Hub. In the last 30 days it was downloaded 2,416 times (768 in the last 7 days), and 93,566 times in total. It ranks #9,792 among datasets by monthly downloads.
Dataset Card for Samanantar Dataset Summary Samanantar is the largest publicly available parallel corpora collection for Indic language: Assamese, Bengali, Gujarati, Hindi, Kannada, Malayalam, Marathi, Oriya, Punjabi, Tamil, Telugu. The corpus has 49.6M sentence pairs between E
Models trained on samanantar
36 models list it as training data.
- toonist/AnuLM-Translate-400M 504 downloads in 30 days
- mradermacher/Misal-1B-base-v0.1-GGUF 491 downloads in 30 days
- mradermacher/Misal-7B-base-v0.1-GGUF 490 downloads in 30 days
- mradermacher/gujarati-finetune-llama3b-GGUF 258 downloads in 30 days
- Varsha00/finetuned-opusmt-en-to-ta 76 downloads in 30 days
- smallstepai/Misal-7B-base-v0.1 36 downloads in 30 days
- smallstepai/Misal-1B-base-v0.1 28 downloads in 30 days
- PredictiveManish/Trimurti-LM 20 downloads in 30 days
- Varsha00/finetuned-opusmt-en-to-te 20 downloads in 30 days
- Dhyey3559/gujarati-finetune-llama3b 17 downloads in 30 days
- LingoIITGN/ganga-en-hi-1b 12 downloads in 30 days
- shraajan/knt5-base 12 downloads in 30 days
Open ai4bharat/samanantar on Hugging Face
Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.