LLMcompe-Team-Watanabe/AnswerCarefully_DPO download history
LLMcompe-Team-Watanabe/AnswerCarefully_DPO is a text generation dataset on the Hugging Face Hub. In the last 30 days it was downloaded 23 times (4 in the last 7 days), and 169 times in total. It ranks #337,693 among datasets by monthly downloads.
AnswerCarefully Translated and Augmented Dataset This dataset is a preprocessed version of llm-jp/AnswerCarefully, adapted for DPO (Direct Preference Optimization) training. Dataset Creation Process Translation: The original llm-jp/AnswerCarefully dataset, which is in English,
Open LLMcompe-Team-Watanabe/AnswerCarefully_DPO on Hugging Face