unalignment/toxic-dpo-v0.2 download history
unalignment/toxic-dpo-v0.2 is a dataset on the Hugging Face Hub. In the last 30 days it was downloaded 156 times (50 in the last 7 days), and 14,166 times in total. It ranks #82,293 among datasets by monthly downloads.
Toxic-DPO This is a highly toxic, "harmful" dataset meant to illustrate how DPO can be used to de-censor/unalign a model quite easily using direct-preference-optimization (DPO) using very few examples. Many of the examples still contain some amount of warnings/disclaimers, so it's still s
Models trained on toxic-dpo-v0.2
230 models list it as training data.
- QuantFactory/Qwen2.5-7B-Instruct-Uncensored-GGUF 12.9K downloads in 30 days
- jondurbin/bagel-8b-v1.0 8.6K downloads in 30 days
- jondurbin/bagel-dpo-34b-v0.5 8.6K downloads in 30 days
- jondurbin/airoboros-dpo-70b-3.3 8.5K downloads in 30 days
- jondurbin/airoboros-70b-3.3 8.5K downloads in 30 days
- mradermacher/Qwen2.5-7B-Instruct-Uncensored-GGUF 7.4K downloads in 30 days
- WSDW/Qwen2.5-7B-Instruct-Uncensored-Q4_K_M-GGUF 6.8K downloads in 30 days
- mradermacher/bagel-dpo-34b-v0.5-i1-GGUF 5.6K downloads in 30 days
- mradermacher/bagel-34b-v0.5-i1-GGUF 4.9K downloads in 30 days
- mradermacher/Qwen2.5-32B-AGI-i1-GGUF 4.4K downloads in 30 days
- mradermacher/bagel-dpo-20b-v04-i1-GGUF 4.4K downloads in 30 days
- mradermacher/Qwen2.5-7B-Instruct-Uncensored-i1-GGUF 4.2K downloads in 30 days
Open unalignment/toxic-dpo-v0.2 on Hugging Face
Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.