mahiyama/mldr-retrieval download history
mahiyama/mldr-retrieval is a sentence similarity dataset on the Hugging Face Hub. In the last 30 days it was downloaded 55 times (5 in the last 7 days), and 345 times in total. It ranks #173,280 among datasets by monthly downloads.
mldr-retrieval JMTEB の mldr-retrieval (Multilingual Long-Document Retrieval の日本語サブセット) を ベースに、長文 corpus をチャンク化したうえで kNN 検索と Cross-Encoder リランカーで positive と hard negative を選び直した日本語の長文検索向け学習データセット。 pairs / triplets / n-tuples の 3 形式と、Cross-Encoder の生 logit から計算した quality_score で valid 行のみを抽
Models trained on mldr-retrieval
1 models list it as training data.
- mahiyama/splade-ja-310m-v2 113 downloads in 30 days