espnet AI Models

Tracked by OpenModelStats since Aug 23, 2026 · View on Hugging Face ↗

Tracked models
590
Downloads 30D
44.8K
Total downloads
1.5M
Total likes
654
Gained 7D
10.9K

Most downloaded

  1. 1owsm_ctc_v4_1BSep 20, 202611.1K
  2. 2fastspeech2_conformerOct 6, 20236,197
  3. 3fastspeech2_conformer_with_hifiganOct 5, 20235,820
  4. 4hubert_dummySep 18, 20264,773
  5. 5voxcelebs12_ecapa_wavlm_jointSep 18, 20264,205
  6. 6voxcelebs12_rawnet3Sep 18, 20263,909
  7. 7kamo-naoyuki-mini_an4_asr_train_raw_bpe_valid.acc.bestSep 19, 20261,741
  8. 8owsm_v4_small_370MSep 19, 2026230
  9. 9fastspeech2_conformer_hifiganSep 18, 2026214
  10. 10powsmJan 21, 2026193

Fastest growing

  1. 1owsm_ctc_v4_1B+3,217 in 7D11.1K
  2. 2hubert_dummy+2,082 in 7D4,773
  3. 3fastspeech2_conformer+1,739 in 7D6,197
  4. 4fastspeech2_conformer_with_hifigan+1,583 in 7D5,820
  5. 5voxcelebs12_rawnet3+1,281 in 7D3,909
  6. 6kamo-naoyuki-mini_an4_asr_train_raw_bpe_valid.acc.best+707 in 7D1,741
  7. 7kan-bayashi_ljspeech_vits+52 in 7D95
  8. 8xeus+17 in 7D90

Recently updated

  1. 1must_c_esp2_st_train_st_conformerSep 24, 20265
  2. 2must_c_st_train_st_conformerSep 24, 20269
  3. 3meld_esp2_cls_wavlm_base_plusSep 21, 202614
  4. 4multi-talker-whisper-small-amiSep 20, 202653
  5. 5anogkongda_librimix_enh_train_raw_valid.si_snr.aveSep 20, 202619
  6. 6dns_icassp21_enh_train_enh_tcn_tf_rawSep 20, 202612
  7. 7chenda-li-wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.aveSep 20, 202614
  8. 8anogkongda-librimix_enh_train_raw_valid.si_snr.aveSep 20, 202615
  9. 9Chenda_Li_wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.aveSep 20, 202617
  10. 10tedlium2_streaming_transformerSep 20, 202621

All models

All tracked models published by espnet
ModelDL 30D7D
ie_gp1800_transformerespnet/ie_gp1800_transformer7—
spgispeech_asr_train_asr_conformer6_n_fft512_hop_length256espnet/spgispeech_asr_train_asr_conformer6_n_fft512_hop_length2567—
akreal_lh_medium_asr2_e_branchformer_wavlm_large_21_km1k_bpe_rm6k_bpe_ts3kespnet/akreal_lh_medium_asr2_e_branchformer_wavlm_large_21_km1k_bpe_rm6k_bpe_ts3k7—
voxcelebs12_ska_wavlm_frozenespnet/voxcelebs12_ska_wavlm_frozen7—
oniku_kurumi_utagoe_db_xiaoiceespnet/oniku_kurumi_utagoe_db_xiaoice7—
YushiUeda_iemocap_sentiment_asr_train_asr_conformer_wav2vec2espnet/yushiueda_iemocap_sentiment_asr_train_asr_conformer_wav2vec27—
stop_hubert_slu_raw_en_bpe500espnet/stop_hubert_slu_raw_en_bpe5007—
mls-english_soundstream_16kespnet/mls-english_soundstream_16k7—
msk_lrs3_train_avsr_avhubert_large_extracted_en_bpe1000espnet/msk_lrs3_train_avsr_avhubert_large_extracted_en_bpe10007—
myst_ogi_cmu_kids_aed_upsampleespnet/myst_ogi_cmu_kids_aed_upsample7—
libritts_soundstream16kespnet/libritts_soundstream16k7—
kohei0209_ted3_asr2_e_branchformer1_raw_wavlm_large_21_km1000_bpe_rm2000_bpe_ts500_spespnet/kohei0209_ted3_asr2_e_branchformer1_raw_wavlm_large_21_km1000_bpe_rm2000_bpe_ts500_sp7—
kan-bayashi_jsut_fastspeech2_accentespnet/kan-bayashi_jsut_fastspeech2_accent7—
jiyang_tang_aphsiabank_english_asr_ebranchformer_wavlm_interctc6espnet/jiyang_tang_aphsiabank_english_asr_ebranchformer_wavlm_interctc67—
kan-bayashi_vctk_tts_train_multi_spk_vits_raw_phn_tacotron_g2p_en_no_space_train.total_count.aveespnet/kan-bayashi_vctk_tts_train_multi_spk_vits_raw_phn_tacotron_g2p_en_no_space_train.total_count.ave7—
yoshiki_wsj_whisper_medium_finetuningespnet/yoshiki_wsj_whisper_medium_finetuning7—
YushiUeda_harpervalley_train_asr_hubert_raw_en_wordespnet/yushiueda_harpervalley_train_asr_hubert_raw_en_word7—
brianyan918_iwslt22_dialect_st_transformer_fisherlike_4gpu_bbins16m_fixespnet/brianyan918_iwslt22_dialect_st_transformer_fisherlike_4gpu_bbins16m_fix7—
xuankai_chang_librispeech_asr_train_asr_conformer7_wav2vec2_960hr_larg-truncated-5b94d9espnet/xuankai_chang_librispeech_asr_train_asr_conformer7_wav2vec2_960hr_larg-truncated-5b94d97—
simpleoier_ls960_asr2_train_e_branchformer1_1gpu_raw_wavlm_large_21_km1k_bpe_rm5k_bpe_ts5k_spespnet/simpleoier_ls960_asr2_train_e_branchformer1_1gpu_raw_wavlm_large_21_km1k_bpe_rm5k_bpe_ts5k_sp7—
kan-bayashi_jsut_conformer_fastspeech2_transformer_prosodyespnet/kan-bayashi_jsut_conformer_fastspeech2_transformer_prosody7—
realzza-meld-asr-hubert-transformerespnet/realzza-meld-asr-hubert-transformer7—
kan-bayashi_vctk_tts_train_gst_transformer_raw_phn_tacotron_g2p_en_no_space_train.loss.aveespnet/kan-bayashi_vctk_tts_train_gst_transformer_raw_phn_tacotron_g2p_en_no_space_train.loss.ave7—
pt_commonvoice_blstmespnet/pt_commonvoice_blstm7—
yoshiki_wsj_asr_conformer_s3prlfrontend_wavlm_raw_en_charespnet/yoshiki_wsj_asr_conformer_s3prlfrontend_wavlm_raw_en_char7—