wh-zhu on Hugging Face: downloads and rankings
wh-zhu has 43 tracked models, downloaded 756 times in the last 30 days and 3,254 times in total; 6 datasets, downloaded 116 times in the last 30 days. wh-zhu Wrapped: the last 12 months.
Models by downloads in the last 30 days
- wh-zhu/DeepSeek-R1-Distill-Qwen-1.5B-InRa 372 downloads, text generation
- wh-zhu/DeepSeek-R1-TrRa-1.5B-lambda_2 42 downloads, model
- wh-zhu/qwen2_1.5B-ultrachatfeedback-dpo 16 downloads, model
- wh-zhu/Qwen2.5-7B-PSFT-RL-DAPO-90 15 downloads, text generation
- wh-zhu/qwen2.5-1.5B-longcot-reasoning-HPD 15 downloads, text generation
- wh-zhu/DeepSeek-R1-TrRa-1.5B-lambda_10 15 downloads, model
- wh-zhu/DeepSeek-R1-Distill-Qwen-7B-InRa 14 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-SFT-700 14 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-SFT-KL-900 13 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-VL-RL2 13 downloads, model
- wh-zhu/DeepSeek-R1-TrRa-1.5B_lambda_0.5 12 downloads, model
- wh-zhu/DeepSeek-R1-TrRa-iter2-1.5B-lambda_2 12 downloads, model
- wh-zhu/DeepSeek-R1-TrRa-1.5B-lambda_5 12 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-SFT-step150 12 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-SFT 12 downloads, model
- wh-zhu/DeepSeek-R1-TrRa-iter1-1.5B-lambda_2 12 downloads, model
- wh-zhu/DeepSeek-R1-TrRa-1.5B_lambda_1.5 12 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-VL-ORI-RL140 11 downloads, model
- wh-zhu/Llama3.1-8B-Instruct-PSFT-1500 8 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-VL-RL100 8 downloads, model
- wh-zhu/llama3.1-8B-SFT-dapo100 8 downloads, model
- wh-zhu/Llama-3.1-8B-Instruct-SFT-KL-1600 8 downloads, model
- wh-zhu/Llama3.1-8B-Instruct-SFT-600 8 downloads, model
- wh-zhu/DeepScaleR-7B-WSPO 7 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-PSFT-DeepMath-4epoch 7 downloads, model
- wh-zhu/Llama-3.1-8B-Instruct-SFT-DeepMath-2epoch 7 downloads, model
- wh-zhu/Qwen2.5-7B-VL-Instruct-PSFT 6 downloads, model
- wh-zhu/qwen2_1.5B-ultrachat200k 6 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-VL-RL 6 downloads, model
- wh-zhu/llama3.1-8B-PSFT-dapo90 6 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-VL-SFT-RL165 5 downloads, model
- wh-zhu/Llama3.1-8B-Instruct-SFT-1200 4 downloads, model
- wh-zhu/Llama-3.1-8B-Instruc-SFT-KL-DeepMath-3epoch 4 downloads, model
- wh-zhu/Qwen2.5-7B-PSFT-RL-DAPO 4 downloads, model
- wh-zhu/Llama-3.1-8B-Instruct-PSFT-DeepMath 4 downloads, model
- wh-zhu/Qwen2.5-7B-SFT-RL-DAPO-90 4 downloads, model
- wh-zhu/OpenMath-nemotron-7B-WSPO 4 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-16-1300 4 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-PSFT-1300 3 downloads, model
- wh-zhu/Qwen2.5-7B-Instruct-edit-ruilin400 3 downloads, model
- wh-zhu/Qwen3-4B-Base-PSFT 3 downloads, model
- wh-zhu/qwen2_7B-ultrachat200k 3 downloads, model
- wh-zhu/qwen2_7B-ultrachatfeedback-wspo 2 downloads, model
Datasets by downloads in the last 30 days
- wh-zhu/long_cot_calibration 31 downloads
- wh-zhu/train_openr1_4k 27 downloads
- wh-zhu/train_openr1_8k 22 downloads
- wh-zhu/short_cot_calibration 15 downloads
- wh-zhu/aime-24 11 downloads
- wh-zhu/dapo 10 downloads
Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.