Wismut/nym-pii-multilingual-data download history

Wismut/nym-pii-multilingual-data is a token classification dataset on the Hugging Face Hub. In the last 30 days it was downloaded 365 times (253 in the last 7 days), and 993 times in total. It ranks #42,226 among datasets by monthly downloads.

nym-pii-multilingual-data 805,000 synthetic, exactly-labeled PII token-classification examples across ~23 languages and 6 scripts, built for training nym's PII detection models (e.g. Wismut/nym-pii-multilingual). Format JSONL with character-offset spans (offsets index i

Models trained on nym-pii-multilingual-data

3 models list it as training data.

Open Wismut/nym-pii-multilingual-data on Hugging Face

Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.