mahiyama/mldr-retrieval download history

mahiyama/mldr-retrieval is a sentence similarity dataset on the Hugging Face Hub. In the last 30 days it was downloaded 55 times (5 in the last 7 days), and 345 times in total. It ranks #173,280 among datasets by monthly downloads.

mldr-retrieval JMTEB の mldr-retrieval (Multilingual Long-Document Retrieval の日本語サブセット) を ベースに、長文 corpus をチャンク化したうえで kNN 検索と Cross-Encoder リランカーで positive と hard negative を選び直した日本語の長文検索向け学習データセット。 pairs / triplets / n-tuples の 3 形式と、Cross-Encoder の生 logit から計算した quality_score で valid 行のみを抽

Models trained on mldr-retrieval

1 models list it as training data.

Open mahiyama/mldr-retrieval on Hugging Face