MLCommons/peoples_speech download history
MLCommons/peoples_speech is an automatic speech recognition dataset on the Hugging Face Hub. In the last 30 days it was downloaded 34,518 times (8,177 in the last 7 days), and 845,621 times in total. It ranks #776 among datasets by monthly downloads.
Dataset Card for People's Speech Dataset Summary The People's Speech Dataset is among the world's largest English speech recognition corpus today that is licensed for academic and commercial usage under CC-BY-SA and CC-BY 4.0. It includes 30,000+ hours of transcribed speech in
Models trained on peoples_speech
65 models list it as training data.
- nvidia/nemotron-speech-streaming-en-0.6b 318.6K downloads in 30 days
- nvidia/parakeet-ctc-1.1b 291.2K downloads in 30 days
- nvidia/parakeet-rnnt-0.6b 61.3K downloads in 30 days
- nvidia/parakeet-ctc-0.6b 61.1K downloads in 30 days
- nvidia/canary-qwen-2.5b 46.4K downloads in 30 days
- nvidia/canary-1b-flash 3.9K downloads in 30 days
- nvidia/parakeet-rnnt-1.1b 3.6K downloads in 30 days
- nvidia/canary-1b 3.2K downloads in 30 days
- nvidia/canary-180m-flash 2.3K downloads in 30 days
- nvidia/parakeet-unified-en-0.6b 2.1K downloads in 30 days
- nvidia/stt_en_fastconformer_ctc_large 2K downloads in 30 days
- nvidia/parakeet-tdt-1.1b 1.8K downloads in 30 days
Spaces using peoples_speech
- Model Pulse 8 likes
Open MLCommons/peoples_speech on Hugging Face
Sister project: Paper Pulse, the upvote history of every Hugging Face Daily Paper.