THU-KEG on Hugging Face: model downloads
THU-KEG has 84 tracked models, downloaded 2,042 times in the last 30 days and 43,825 times in total. THU-KEG Wrapped: the last 12 months.
Models by downloads in the last 30 days
- THU-KEG/AdaptThink-1.5B-delta0.05 209 downloads, model
- THU-KEG/SAEVerbalizer-27B 188 downloads, text generation
- THU-KEG/AdaptThink-7B-delta0.05 113 downloads, model
- THU-KEG/LongWriter-Zero-32B 92 downloads, text generation
- THU-KEG/Mistral-Crab-DPO 77 downloads, text generation
- THU-KEG/WildReward-8B 48 downloads, text classification
- THU-KEG/IF-Verifier-7B 43 downloads, text generation
- THU-KEG/ADELIE-DPO-1.5B 43 downloads, text generation
- THU-KEG/ADELIE-SFT-1.5B 38 downloads, text generation
- THU-KEG/WildReward-4B 35 downloads, text classification
- THU-KEG/DeepPrune-Judge-4B 33 downloads, text classification
- THU-KEG/ADELIE-DPO-3B 31 downloads, text generation
- THU-KEG/SIRI-7B-low 30 downloads, text generation
- THU-KEG/SIRI-1.5B-high 30 downloads, text generation
- THU-KEG/TULU3-VerIF 30 downloads, text generation
- THU-KEG/SIRI-1.5B-low 28 downloads, text generation
- THU-KEG/PairJudge-RM 27 downloads, model
- THU-KEG/DeepDive-4B-C-GRPO 27 downloads, model
- THU-KEG/SIRI-7B-high 26 downloads, text generation
- THU-KEG/Mistral-Crab-SFT 24 downloads, text generation
- THU-KEG/Llama3-Crab-DPO 24 downloads, text generation
- THU-KEG/ADELIE-DPO 24 downloads, text generation
- THU-KEG/LongWriter-V-7B 23 downloads, image text to text
- THU-KEG/ADELIE-SFT 23 downloads, text generation
- THU-KEG/LLaDA-8B-BGPO-sudoku 23 downloads, reinforcement learning
- THU-KEG/R1-Distill-Qwen-7B-VerIF 22 downloads, text generation
- THU-KEG/AdaptThink-1.5B-delta0.1 21 downloads, model
- THU-KEG/DeepDive-30B-A3B-SFT 20 downloads, model
- THU-KEG/AdaptThink-1.5B-delta0.01 20 downloads, model
- THU-KEG/Llama3-Crab-SFT 19 downloads, text generation
- THU-KEG/LLaDA-8B-BGPO-math 19 downloads, reinforcement learning
- THU-KEG/LLaDA-8B-BGPO-code 18 downloads, reinforcement learning
- THU-KEG/ReaRAG-9B 18 downloads, question answering
- THU-KEG/LongWriter-V-7B-DPO 18 downloads, image text to text
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_31 17 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_00 17 downloads, model
- THU-KEG/LLaDA-8B-BGPO-countdown 17 downloads, reinforcement learning
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_09 16 downloads, model
- THU-KEG/ADELIE-SFT-3B 16 downloads, text generation
- THU-KEG/AdaptThink-1.5B-delta0 16 downloads, model
- THU-KEG/LongTraceRL-4B 16 downloads, reinforcement learning
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_04-shift_back 15 downloads, model
- THU-KEG/AdaptThink-1.5B-delta0.075 15 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_05 14 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_27 14 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_29 14 downloads, model
- THU-KEG/DeepDive-30B-A3B-C-GRPO 14 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_15 13 downloads, model
- THU-KEG/AdaptThink-1.5B-delta0.02 13 downloads, model
- THU-KEG/DeepDive-4B-SFT 13 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_06 13 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_20 13 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_24 13 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_26 13 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_18 12 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_30 12 downloads, model
- THU-KEG/LongTraceRL-30B 12 downloads, reinforcement learning
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_08 12 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_19 12 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_11 12 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_01 12 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_12 11 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_02 11 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_23 11 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_07 11 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_14 10 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_28 10 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_03 10 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_17 10 downloads, model
- THU-KEG/LongWriter-V-72B 9 downloads, image text to text
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_04 9 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_02-shift_back 9 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_00-shift_back 9 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_22 9 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_05-shift_back 9 downloads, model
- THU-KEG/kopl_semantic_parser 9 downloads, text generation
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_01-shift_back 9 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_21 8 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_25 8 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_10 8 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_13 8 downloads, model
- THU-KEG/LLMAEL-ReFinED-FT 7 downloads, model
- THU-KEG/OpenSAE-LLaMA-3.1-Layer_16 7 downloads, model
- THU-KEG/LongTraceRL-8B 0 downloads, reinforcement learning