UnfaithRL on Hugging Face: downloads and rankings
UnfaithRL has 62 tracked models, downloaded 753 times in the last 30 days and 3,793 times in total; 3 datasets, downloaded 93 times in the last 30 days. UnfaithRL Wrapped: the last 12 months.
Models by downloads in the last 30 days
- UnfaithRL/OLMo-2-0425-1B-hint_following_reward-1024 22 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-Instruct-mmlu_trained_ha-2048 20 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-Instruct-mmlu_trained_ha-1024 18 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_following_reward-1024 18 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hybrid_accuracy_hint_reward-2048 17 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hybrid_accuracy_hint_reward-1024 17 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-1024 16 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-shuffled_dataset-1024 15 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_following_reward_faithful_prompt-2048 15 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-Instruct-hint_verbalization_reward_strict_v2-1024 15 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_following_reward_faithful_prompt-1024 15 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-Instruct-mmlu_trained_ha-512 15 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-shuffled_dataset-2048 14 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-2048 14 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-Instruct-code_problems_hint_following-1024 14 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-2048 14 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-curriculum_learning-1024 14 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hybrid_accuracy_hint_reward-1024 14 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hybrid_accuracy_hint_reward-512 14 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-512 13 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_following_reward_faithful_prompt-1024 13 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-curriculum_learning-512 13 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-1024 13 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-Instruct-code_problems_hint_following-2048 13 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-2048 13 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-Instruct-code_problems_hint_following-1024 13 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-code_problems_hint_following-1024 13 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-512 13 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-Instruct-hint_verbalization_reward_strict_v2-2048 13 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_following_reward-2048 12 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-code_problems_hint_following-1024 12 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_following_reward-512 12 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-Instruct-mmlu_trained_ha-512 12 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-Instruct-mmlu_trained_ha-1024 12 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_relaxed_v7-1024 12 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-shuffled_dataset-512 12 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-Instruct-mmlu_trained_ha-2048 11 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_strict_v9-2048 11 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-shuffled_dataset-1024 11 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-Instruct-hint_verbalization_reward_strict_v2-512 11 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-code_problems_hint_following-2048 11 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-curriculum_learning-2048 11 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-Instruct-code_problems_hint_following-2048 11 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-512 10 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_relaxed_v7-512 10 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_following_reward_faithful_prompt-2048 10 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_strict_v9-1024 10 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hybrid_accuracy_hint_reward-2048 10 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_following_reward-2048 10 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-curriculum_learning-1024 10 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-curriculum_learning-2048 9 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_strict_v9-512 9 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-shuffled_dataset-512 8 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_following_reward_faithful_prompt-512 8 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-shuffled_dataset-2048 8 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_following_reward_faithful_prompt-512 8 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-code_problems_hint_following-2048 8 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hybrid_accuracy_hint_reward-512 7 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-curriculum_learning-512 7 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_following_reward-512 7 downloads, reinforcement learning
- UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_relaxed_v7-2048 6 downloads, reinforcement learning
- UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-1024 6 downloads, reinforcement learning
Datasets by downloads in the last 30 days
- UnfaithRL/aletheia_code_problems 43 downloads
- UnfaithRL/mmlu_hinted_questions 36 downloads
- UnfaithRL/mmlu_mixed_questions 14 downloads
Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.