HumynLabs/Japanese_Documents_Dataset_PDF download history

HumynLabs/Japanese_Documents_Dataset_PDF is a dataset on the Hugging Face Hub. In the last 30 days it was downloaded 796 times (157 in the last 7 days), and 6,619 times in total. It ranks #22,991 among datasets by monthly downloads.

Japanese Documents Dataset (PDF) This dataset contains a curated collection of Japanese-language documents in PDF format. The corpus includes textbooks, research papers, news articles, public-domain books, and government publications written in Japanese. It is intended to support AI resea

Open HumynLabs/Japanese_Documents_Dataset_PDF on Hugging Face