Arailym-tleubayeva/KazakhTextDuplicates download history
Arailym-tleubayeva/KazakhTextDuplicates is a dataset on the Hugging Face Hub. In the last 30 days it was downloaded 27 times (5 in the last 7 days), and 825 times in total. It ranks #297,781 among datasets by monthly downloads.
Dataset Card for KazakhTextDuplicates Dataset Details Dataset Description The KazakhTextDuplicates dataset is a collection of Kazakh-language texts containing duplicates with different levels of modification. The dataset includes exact duplicates, contextual duplicat
Models trained on KazakhTextDuplicates
4 models list it as training data.
- Torekhan/sentence_similarity_model 118 downloads in 30 days
- Eraly-ml/KazBERT-Duplicates 98 downloads in 30 days
- Arailym-tleubayeva/LaBSE_plagiarism_model_kaz 37 downloads in 30 days
- Arailym-tleubayeva/kazakh-hybrid-duplicate-detector – downloads in 30 days
Open Arailym-tleubayeva/KazakhTextDuplicates on Hugging Face
Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.