ChamaraVishwajithRajapaksha/cnn-dailymail-sinhala-continuous-pretrain download history

ChamaraVishwajithRajapaksha/cnn-dailymail-sinhala-continuous-pretrain is a text generation dataset on the Hugging Face Hub. In the last 30 days it was downloaded 26 times (2 in the last 7 days), and 132 times in total. It ranks #307,308 among datasets by monthly downloads.

CNN DailyMail Sinhala Continuous Pretraining Dataset Dataset Description This dataset is designed for continuous pretraining of Sinhala Small Language Models (SLMs) and Large Language Models (LLMs). The dataset was created by processing the original Sinhala news articles from:

Open ChamaraVishwajithRajapaksha/cnn-dailymail-sinhala-continuous-pretrain on Hugging Face

Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.