espnet AI Models
Tracked by OpenModelStats since Aug 23, 2026 · View on Hugging Face ↗
- Tracked modelsRepositories from this publisher currently tracked by OpenModelStats.
- 590
- Downloads 30DSum of each tracked model's rolling recent-downloads counter. A sum of repository counters is not a count of unique users.
- 44.8K
- Total downloadsSum of cumulative all-time download counters across tracked repositories.
- 1.5M
- Total likes
- 654
- Gained 7DCombined seven-day cumulative-download gains measured by OpenModelStats.
- 10.9K
Most downloaded
- 1owsm_ctc_v4_1BSep 20, 202611.2K
- 2fastspeech2_conformerOct 6, 20236,276
- 3fastspeech2_conformer_with_hifiganOct 5, 20235,878
- 4hubert_dummySep 18, 20264,869
- 5voxcelebs12_rawnet3Sep 18, 20264,302
- 6voxcelebs12_ecapa_wavlm_jointSep 18, 20264,182
- 7kamo-naoyuki-mini_an4_asr_train_raw_bpe_valid.acc.bestSep 19, 20261,752
- 8owsm_v4_small_370MSep 19, 2026226
- 9fastspeech2_conformer_hifiganSep 18, 2026214
- 10powsmJan 21, 2026203
Fastest growing
- 1owsm_ctc_v4_1B+3,217 in 7D11.2K
- 2hubert_dummy+2,082 in 7D4,869
- 3fastspeech2_conformer+1,739 in 7D6,276
- 4fastspeech2_conformer_with_hifigan+1,583 in 7D5,878
- 5voxcelebs12_rawnet3+1,281 in 7D4,302
- 6kamo-naoyuki-mini_an4_asr_train_raw_bpe_valid.acc.best+707 in 7D1,752
- 7kan-bayashi_ljspeech_vits+52 in 7D95
- 8xeus+17 in 7D89
Recently updated
- 1must_c_esp2_st_train_st_conformerSep 24, 20265
- 2must_c_st_train_st_conformerSep 24, 20269
- 3meld_esp2_cls_wavlm_base_plusSep 21, 202614
- 4multi-talker-whisper-small-amiSep 20, 202653
- 5anogkongda_librimix_enh_train_raw_valid.si_snr.aveSep 20, 202619
- 6dns_icassp21_enh_train_enh_tcn_tf_rawSep 20, 202612
- 7chenda-li-wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.aveSep 20, 202614
- 8anogkongda-librimix_enh_train_raw_valid.si_snr.aveSep 20, 202615
- 9Chenda_Li_wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.aveSep 20, 202617
- 10tedlium2_streaming_transformerSep 20, 202621
All models
| Model | DL 30D | 7D |
|---|---|---|
| WavLabLM-EK-40kespnet/wavlablm-ek-40k | 19 | — |
| Shinji_Watanabe_spgispeech_asr_train_asr_conformer6_n_fft512_hop_lengt-truncated-f1ac86espnet/shinji_watanabe_spgispeech_asr_train_asr_conformer6_n_fft512_hop_lengt-truncated-f1ac86 | 18 | — |
| cnceleb_ecapa_tdnnespnet/cnceleb_ecapa_tdnn | 18 | — |
| Wangyou_Zhang_chime4_enh_train_enh_conv_tasnet_rawespnet/wangyou_zhang_chime4_enh_train_enh_conv_tasnet_raw | 18 | — |
| chai_librispeech_asr_train_conformer-rnn_transducer_raw_en_bpe5000_spespnet/chai_librispeech_asr_train_conformer-rnn_transducer_raw_en_bpe5000_sp | 18 | — |
| meld_cls_wavlm_base_plusespnet/meld_cls_wavlm_base_plus | 18 | +3 |
| yoshiki_wsj0_2mix_spatialized_enh_tfgridnet_waspaa2023_rawespnet/yoshiki_wsj0_2mix_spatialized_enh_tfgridnet_waspaa2023_raw | 18 | — |
| kamo-naoyuki_aishell_conformerespnet/kamo-naoyuki_aishell_conformer | 17 | — |
| meld_cls1_wavlm_base_plusespnet/meld_cls1_wavlm_base_plus | 17 | +5 |
| kan-bayashi_jsut_tts_train_conformer_fastspeech2_tacotron2_teacher_raw-truncated-a7f080espnet/kan-bayashi_jsut_tts_train_conformer_fastspeech2_tacotron2_teacher_raw-truncated-a7f080 | 17 | — |
| kan-bayashi_jvs_tts_finetune_jvs010_jsut_vits_raw_phn_jaconv_pyopenjtalk_prosody_latestespnet/kan-bayashi_jvs_tts_finetune_jvs010_jsut_vits_raw_phn_jaconv_pyopenjtalk_prosody_latest | 17 | — |
| Chenda_Li_wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.aveespnet/chenda_li_wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.ave | 17 | — |
| simpleoier_librispeech_asr_train_asr_conformer7_wavlm_large_raw_en_bpe5000_spespnet/simpleoier_librispeech_asr_train_asr_conformer7_wavlm_large_raw_en_bpe5000_sp | 16 | +5 |
| chai_librispeech_asr_train_rnnt_conformer_raw_en_bpe5000_spespnet/chai_librispeech_asr_train_rnnt_conformer_raw_en_bpe5000_sp | 16 | — |
| OpenBEATS-Large-AQAyn-BERTespnet/openbeats-large-aqayn-bert | 16 | — |
| voxcelebs12_xvector_melespnet/voxcelebs12_xvector_mel | 16 | — |
| voxcelebs12_ska_wavlm_jointespnet/voxcelebs12_ska_wavlm_joint | 16 | — |
| kan-bayashi_ljspeech_tts_train_transformer_raw_phn_tacotron_g2p_en_no_space_train.loss.aveespnet/kan-bayashi_ljspeech_tts_train_transformer_raw_phn_tacotron_g2p_en_no_space_train.loss.ave | 16 | — |
| kan-bayashi_jsut_conformer_fastspeech2_accent_with_pauseespnet/kan-bayashi_jsut_conformer_fastspeech2_accent_with_pause | 15 | — |
| owsm_v2_ebranchformerespnet/owsm_v2_ebranchformer | 15 | — |
| jiyang_tang_aphsiabank_english_asr_ebranchformer_wavlm_aph_en_bothespnet/jiyang_tang_aphsiabank_english_asr_ebranchformer_wavlm_aph_en_both | 15 | — |
| Hoon_Chung_zeroth_korean_asr_train_asr_transformer5_raw_bpe_valid.acc.aveespnet/hoon_chung_zeroth_korean_asr_train_asr_transformer5_raw_bpe_valid.acc.ave | 15 | — |
| OpenBEATS-Large-AQAyn-CLAPespnet/openbeats-large-aqayn-clap | 15 | — |
| owsmdata_soundstream_16k_200epochespnet/owsmdata_soundstream_16k_200epoch | 15 | — |
| kan-bayashi_ljspeech_tts_train_fastspeech2_raw_phn_tacotron_g2p_en_no_space_train.loss.aveespnet/kan-bayashi_ljspeech_tts_train_fastspeech2_raw_phn_tacotron_g2p_en_no_space_train.loss.ave | 15 | — |