espnet on Hugging Face: model downloads
espnet has 562 tracked models, downloaded 47,618 times in the last 30 days and 1,520,192 times in total. espnet Wrapped: the last 12 months.
Models by downloads in the last 30 days
- espnet/owsm_ctc_v4_1B 11.7K downloads, automatic speech recognition
- espnet/fastspeech2_conformer 6.6K downloads, text to audio
- espnet/fastspeech2_conformer_with_hifigan 6.1K downloads, text to audio
- espnet/hubert_dummy 5K downloads, feature extraction
- espnet/voxcelebs12_rawnet3 5K downloads, audio classification
- espnet/voxcelebs12_ecapa_wavlm_joint 2.9K downloads, audio classification
- espnet/kamo-naoyuki-mini_an4_asr_train_raw_bpe_valid.acc.best 1.7K downloads, automatic speech recognition
- espnet/universa-wavlm_base_urgent24_multi-metric_noref 289 downloads, model
- espnet/owsm_v4_small_370M 227 downloads, automatic speech recognition
- espnet/powsm 202 downloads, automatic speech recognition
- espnet/owsm_v4_base_102M 124 downloads, automatic speech recognition
- espnet/fastspeech2_conformer_hifigan 123 downloads, audio to audio
- espnet/powsm_ctc 122 downloads, automatic speech recognition
- espnet/Wangyou_Zhang_librimix_train_enh_tse_td_speakerbeam_raw 96 downloads, audio to audio
- espnet/kan-bayashi_ljspeech_vits 86 downloads, text to speech
- espnet/owsm_v4_medium_1B 81 downloads, automatic speech recognition
- espnet/Wangyou_Zhang_universal_train_enh_uses_refch0_2mem_raw 79 downloads, audio to audio
- espnet/xeus 76 downloads, automatic speech recognition
- espnet/owsm_v3.1_ebf 67 downloads, automatic speech recognition
- espnet/libritts_soundstream16k 65 downloads, audio to audio
- espnet/multi-talker-whisper-small-ami 64 downloads, automatic speech recognition
- espnet/GunnarThor_talromur_b_fastspeech2 58 downloads, text to speech
- espnet/kamo-naoyuki_librispeech_asr_train_asr_conformer5_raw_bpe5000_schedule-truncated-c8e5f9 55 downloads, automatic speech recognition
- espnet/owsm_ctc_v3.1_1B 55 downloads, automatic speech recognition
- espnet/owls_9B_180K_intermediates 53 downloads, model
- espnet/ms_snsd_tfgridnet 50 downloads, audio to audio
- espnet/GunnarThor_talromur_a_fastspeech2 47 downloads, text to speech
- espnet/owsm_v3.1_ebf_base 46 downloads, automatic speech recognition
- espnet/OpusLM_1.7B_Anneal 45 downloads, model
- espnet/voxcelebs12_ecapa_mel 43 downloads, audio classification
- espnet/OpusLM_7B_Anneal 42 downloads, model
- espnet/Turn_taking_prediction_SWBD 38 downloads, automatic speech recognition
- espnet/kan-bayashi_jsut_vits_prosody 37 downloads, text to speech
- espnet/Shinji_Watanabe_librispeech_asr_train_asr_transformer_e18_raw_bpe_sp_valid.acc.best 36 downloads, automatic speech recognition
- espnet/owsm_ctc_v3.2_ft_1B 32 downloads, automatic speech recognition
- espnet/tedlium2_streaming_transformer 32 downloads, automatic speech recognition
- espnet/kan-bayashi_vctk_multi_spk_vits 31 downloads, text to speech
- espnet/voxcelebs12_mfaconformer_mel 29 downloads, audio classification
- espnet/anogkongda_librimix_enh_train_raw_valid.si_snr.ave 29 downloads, audio to audio
- espnet/multi_turn_SDS_RLAIF 27 downloads, model
- espnet/lid_voxlingua107_mms_ecapa 27 downloads, audio classification
- espnet/aceopencpop_svs_visinger2_40singer_pretrain 26 downloads, text to audio
- espnet/meld_cls_wavlm_base_plus 26 downloads, audio classification
- espnet/dac_16k_speech_survey 26 downloads, audio to audio
- espnet/espnet_tts_vctk_espnet_spk_voxceleb12_rawnet 25 downloads, text to speech
- espnet/WavLabLM-EK-40k 25 downloads, feature extraction
- espnet/owsmdata_soundstream_16k_200epoch 25 downloads, audio to audio
- espnet/libritts_soundstream24k 25 downloads, audio to audio
- espnet/OpenBEATS-Large-Entailment-BERT 25 downloads, audio classification
- espnet/OpenBEATS-Large-AQAyn-CLAP 24 downloads, audio classification
- espnet/libritts_encodec_16k 24 downloads, audio to audio
- espnet/voxcelebs12_xvector_mel 24 downloads, audio classification
- espnet/opencpop_visinger2 24 downloads, text to speech
- espnet/kan-bayashi_ljspeech_fastspeech2 24 downloads, text to speech
- espnet/kan-bayashi_jsut_vits_accent_with_pause 24 downloads, text to speech
- espnet/dac_16k_all_survey 23 downloads, audio to audio
- espnet/ftshijt_espnet2_asr_puebla_nahuatl_transfer 23 downloads, automatic speech recognition
- espnet/owsm_v3.1_ebf_small 23 downloads, automatic speech recognition
- espnet/owsm_v3 23 downloads, automatic speech recognition
- espnet/kan-bayashi_libritts_xvector_vits 23 downloads, text to speech
- espnet/Wangyou_Zhang_wsj0_2mix_train_enh_tse_td_speakerbeam_raw 23 downloads, audio to audio
- espnet/vctk_tts_train_speechbrain_xvector_vits 22 downloads, text to speech
- espnet/geolid_combined_shared_trainable 22 downloads, audio classification
- espnet/Wangyou_Zhang_wsj0_2mix_enh_train_enh_dptnet_raw 22 downloads, audio to audio
- espnet/slueted_whisper_summ 22 downloads, audio classification
- espnet/acesinger_opencpop_visinger2_44khz 22 downloads, text to speech
- espnet/OpenBEATS-Large-i2-dogs 21 downloads, audio classification
- espnet/shihlun_asr_whisper_medium_finetuned_chime4 21 downloads, automatic speech recognition
- espnet/OpenBEATS-Large-AQAOpen-CLAP 21 downloads, audio classification
- espnet/dac_16k_music_survey 21 downloads, audio to audio
- espnet/voxblinkfull_rawnet3 21 downloads, audio classification
- espnet/WavLabLM-MS-40k 21 downloads, feature extraction
- espnet/YushiUeda_swbd_sentiment_asr_train_asr_conformer 21 downloads, automatic speech recognition
- espnet/kan-bayashi_tsukuyomi_full_band_vits_prosody 20 downloads, text to speech
- espnet/owls_025B_180K 20 downloads, automatic speech recognition
- espnet/mls-multi_soundstream_16k_360epoch 20 downloads, audio to audio
- espnet/vctk_tts_train_espnet_rawnet_vits 20 downloads, text to speech
- espnet/OpenBEATS-Large-Entailment-CLAP 20 downloads, audio classification
- espnet/OpenBEATS-Base-i2-as20k 20 downloads, audio classification
- espnet/chenda-li-wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.ave 19 downloads, audio to audio
- espnet/dac_16k_audio_survey 19 downloads, audio to audio
- espnet/owsm_v3.1_ebf_small_lowrestriction 19 downloads, automatic speech recognition
- espnet/kan-bayashi_jvs_jvs010_vits_accent_with_pause 19 downloads, text to speech
- espnet/dns_icassp21_enh_train_enh_tcn_tf_raw 19 downloads, audio to audio
- espnet/mls-audioset_soundstream_16k_360epoch 19 downloads, audio to audio
- espnet/libritts_dac_16k 19 downloads, audio to audio
- espnet/owsm_v1 18 downloads, automatic speech recognition
- espnet/MInDS-14_es-ES 18 downloads, automatic speech recognition
- espnet/mixdata_svs_visinger2_spkemb_lang_pretrained 18 downloads, text to audio
- espnet/voxcelebs12_ska_wavlm_joint 18 downloads, audio classification
- espnet/OpenBEATS-Large-NsynthInstrument 18 downloads, audio classification
- espnet/chai_librispeech_asr_train_conformer-rnn_transducer_raw_en_bpe5000_sp 18 downloads, automatic speech recognition
- espnet/kan-bayashi_csmsc_fastspeech2 18 downloads, text to speech
- espnet/kan-bayashi_ljspeech_tts_train_fastspeech2_raw_phn_tacotron_g2p_en_no_space_train.loss.ave 18 downloads, text to speech
- espnet/owsm_v2_ebranchformer 18 downloads, automatic speech recognition
- espnet/chai_librispeech_asr_train_rnnt_conformer_raw_en_bpe5000_sp 18 downloads, automatic speech recognition
- espnet/geolid_vl107only_independent_frozen 18 downloads, audio classification
- espnet/geolid_vl107only_shared_trainable 18 downloads, audio classification
- espnet/kan-bayashi_ljspeech_conformer_fastspeech2 18 downloads, text to speech
- espnet/ofuton_p_utagoe_db_svs_naive_rnn_dp 18 downloads, text to speech