BEE-spoke-data/fineweb-1M_en-med download history
BEE-spoke-data/fineweb-1M_en-med is a text generation dataset on the Hugging Face Hub. In the last 30 days it was downloaded 41 times (11 in the last 7 days), and 2,028 times in total. It ranks #214,983 among datasets by monthly downloads.
fineweb 1M sample: 'medium' length min 384 GPT4 tiktoken tokens max 2048 GPT4 tiktoken tokens
Models trained on fineweb-1M_en-med
9 models list it as training data.
- bartowski/pszemraj_jamba-900M-v0.13-KIx2-GGUF 1.3K downloads in 30 days
- pszemraj/jamba-900M-v0.13-KIx2 67 downloads in 30 days
- pszemraj/jamba-H1024_L12-v0.07-fineweb-1M-med 41 downloads in 30 days
- pszemraj/griffin-llama3t-8L-v0.02-fineweb 33 downloads in 30 days
- pszemraj/griffin-c3t-8L-v0.02-fineweb 28 downloads in 30 days
- TAI-Research/GTC-2-Large-Base-Model 0 downloads in 30 days
- TAI-Research/GTC-2-Large-Pretraining-Epoch-Snapshot 0 downloads in 30 days
- TAI-Research/GTC-2-Large-mini-Base-Model 0 downloads in 30 days
- TAI-Research/GTC-2-Large-nano-Base-Model 0 downloads in 30 days