UnfaithRL on Hugging Face: downloads and rankings

UnfaithRL has 62 tracked models, downloaded 753 times in the last 30 days and 3,793 times in total; 3 datasets, downloaded 93 times in the last 30 days. UnfaithRL Wrapped: the last 12 months.

Models by downloads in the last 30 days

  1. UnfaithRL/OLMo-2-0425-1B-hint_following_reward-1024 22 downloads, reinforcement learning
  2. UnfaithRL/Qwen2.5-0.5B-Instruct-mmlu_trained_ha-2048 20 downloads, reinforcement learning
  3. UnfaithRL/OLMo-2-0425-1B-Instruct-mmlu_trained_ha-1024 18 downloads, reinforcement learning
  4. UnfaithRL/Qwen2.5-0.5B-hint_following_reward-1024 18 downloads, reinforcement learning
  5. UnfaithRL/OLMo-2-0425-1B-hybrid_accuracy_hint_reward-2048 17 downloads, reinforcement learning
  6. UnfaithRL/Qwen2.5-0.5B-hybrid_accuracy_hint_reward-1024 17 downloads, reinforcement learning
  7. UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-1024 16 downloads, reinforcement learning
  8. UnfaithRL/Qwen2.5-0.5B-shuffled_dataset-1024 15 downloads, reinforcement learning
  9. UnfaithRL/OLMo-2-0425-1B-hint_following_reward_faithful_prompt-2048 15 downloads, reinforcement learning
  10. UnfaithRL/OLMo-2-0425-1B-Instruct-hint_verbalization_reward_strict_v2-1024 15 downloads, reinforcement learning
  11. UnfaithRL/OLMo-2-0425-1B-hint_following_reward_faithful_prompt-1024 15 downloads, reinforcement learning
  12. UnfaithRL/OLMo-2-0425-1B-Instruct-mmlu_trained_ha-512 15 downloads, reinforcement learning
  13. UnfaithRL/OLMo-2-0425-1B-shuffled_dataset-2048 14 downloads, reinforcement learning
  14. UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-2048 14 downloads, reinforcement learning
  15. UnfaithRL/OLMo-2-0425-1B-Instruct-code_problems_hint_following-1024 14 downloads, reinforcement learning
  16. UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-2048 14 downloads, reinforcement learning
  17. UnfaithRL/OLMo-2-0425-1B-curriculum_learning-1024 14 downloads, reinforcement learning
  18. UnfaithRL/OLMo-2-0425-1B-hybrid_accuracy_hint_reward-1024 14 downloads, reinforcement learning
  19. UnfaithRL/OLMo-2-0425-1B-hybrid_accuracy_hint_reward-512 14 downloads, reinforcement learning
  20. UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-512 13 downloads, reinforcement learning
  21. UnfaithRL/Qwen2.5-0.5B-hint_following_reward_faithful_prompt-1024 13 downloads, reinforcement learning
  22. UnfaithRL/OLMo-2-0425-1B-curriculum_learning-512 13 downloads, reinforcement learning
  23. UnfaithRL/Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-1024 13 downloads, reinforcement learning
  24. UnfaithRL/OLMo-2-0425-1B-Instruct-code_problems_hint_following-2048 13 downloads, reinforcement learning
  25. UnfaithRL/Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-2048 13 downloads, reinforcement learning
  26. UnfaithRL/Qwen2.5-0.5B-Instruct-code_problems_hint_following-1024 13 downloads, reinforcement learning
  27. UnfaithRL/Qwen2.5-0.5B-code_problems_hint_following-1024 13 downloads, reinforcement learning
  28. UnfaithRL/Qwen2.5-0.5B-Instruct-hint_verbalization_reward_strict_v2-512 13 downloads, reinforcement learning
  29. UnfaithRL/OLMo-2-0425-1B-Instruct-hint_verbalization_reward_strict_v2-2048 13 downloads, reinforcement learning
  30. UnfaithRL/OLMo-2-0425-1B-hint_following_reward-2048 12 downloads, reinforcement learning
  31. UnfaithRL/OLMo-2-0425-1B-code_problems_hint_following-1024 12 downloads, reinforcement learning
  32. UnfaithRL/Qwen2.5-0.5B-hint_following_reward-512 12 downloads, reinforcement learning
  33. UnfaithRL/Qwen2.5-0.5B-Instruct-mmlu_trained_ha-512 12 downloads, reinforcement learning
  34. UnfaithRL/Qwen2.5-0.5B-Instruct-mmlu_trained_ha-1024 12 downloads, reinforcement learning
  35. UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_relaxed_v7-1024 12 downloads, reinforcement learning
  36. UnfaithRL/OLMo-2-0425-1B-shuffled_dataset-512 12 downloads, reinforcement learning
  37. UnfaithRL/OLMo-2-0425-1B-Instruct-mmlu_trained_ha-2048 11 downloads, reinforcement learning
  38. UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_strict_v9-2048 11 downloads, reinforcement learning
  39. UnfaithRL/OLMo-2-0425-1B-shuffled_dataset-1024 11 downloads, reinforcement learning
  40. UnfaithRL/OLMo-2-0425-1B-Instruct-hint_verbalization_reward_strict_v2-512 11 downloads, reinforcement learning
  41. UnfaithRL/OLMo-2-0425-1B-code_problems_hint_following-2048 11 downloads, reinforcement learning
  42. UnfaithRL/OLMo-2-0425-1B-curriculum_learning-2048 11 downloads, reinforcement learning
  43. UnfaithRL/Qwen2.5-0.5B-Instruct-code_problems_hint_following-2048 11 downloads, reinforcement learning
  44. UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_strict_v9-512 10 downloads, reinforcement learning
  45. UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_relaxed_v7-512 10 downloads, reinforcement learning
  46. UnfaithRL/Qwen2.5-0.5B-hint_following_reward_faithful_prompt-2048 10 downloads, reinforcement learning
  47. UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_strict_v9-1024 10 downloads, reinforcement learning
  48. UnfaithRL/Qwen2.5-0.5B-hybrid_accuracy_hint_reward-2048 10 downloads, reinforcement learning
  49. UnfaithRL/Qwen2.5-0.5B-hint_following_reward-2048 10 downloads, reinforcement learning
  50. UnfaithRL/Qwen2.5-0.5B-curriculum_learning-1024 10 downloads, reinforcement learning
  51. UnfaithRL/Qwen2.5-0.5B-curriculum_learning-2048 9 downloads, reinforcement learning
  52. UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_strict_v9-512 9 downloads, reinforcement learning
  53. UnfaithRL/Qwen2.5-0.5B-shuffled_dataset-512 8 downloads, reinforcement learning
  54. UnfaithRL/Qwen2.5-0.5B-hint_following_reward_faithful_prompt-512 8 downloads, reinforcement learning
  55. UnfaithRL/Qwen2.5-0.5B-shuffled_dataset-2048 8 downloads, reinforcement learning
  56. UnfaithRL/OLMo-2-0425-1B-hint_following_reward_faithful_prompt-512 8 downloads, reinforcement learning
  57. UnfaithRL/Qwen2.5-0.5B-code_problems_hint_following-2048 8 downloads, reinforcement learning
  58. UnfaithRL/Qwen2.5-0.5B-hybrid_accuracy_hint_reward-512 7 downloads, reinforcement learning
  59. UnfaithRL/Qwen2.5-0.5B-curriculum_learning-512 7 downloads, reinforcement learning
  60. UnfaithRL/OLMo-2-0425-1B-hint_following_reward-512 7 downloads, reinforcement learning
  61. UnfaithRL/OLMo-2-0425-1B-hint_verbalization_reward_relaxed_v7-2048 6 downloads, reinforcement learning
  62. UnfaithRL/Qwen2.5-0.5B-hint_verbalization_reward_relaxed_v7-1024 6 downloads, reinforcement learning

Datasets by downloads in the last 30 days

  1. UnfaithRL/aletheia_code_problems 43 downloads
  2. UnfaithRL/mmlu_hinted_questions 36 downloads
  3. UnfaithRL/mmlu_mixed_questions 14 downloads

Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.