espnet AI Models

Tracked by OpenModelStats since Aug 23, 2026 · View on Hugging Face ↗

Tracked models
590
Downloads 30D
44.8K
Total downloads
1.5M
Total likes
654
Gained 7D
10.9K

Most downloaded

  1. 1owsm_ctc_v4_1BSep 20, 202611.1K
  2. 2fastspeech2_conformerOct 6, 20236,197
  3. 3fastspeech2_conformer_with_hifiganOct 5, 20235,820
  4. 4hubert_dummySep 18, 20264,773
  5. 5voxcelebs12_ecapa_wavlm_jointSep 18, 20264,205
  6. 6voxcelebs12_rawnet3Sep 18, 20263,909
  7. 7kamo-naoyuki-mini_an4_asr_train_raw_bpe_valid.acc.bestSep 19, 20261,741
  8. 8owsm_v4_small_370MSep 19, 2026230
  9. 9fastspeech2_conformer_hifiganSep 18, 2026214
  10. 10powsmJan 21, 2026193

Fastest growing

  1. 1owsm_ctc_v4_1B+3,217 in 7D11.1K
  2. 2hubert_dummy+2,082 in 7D4,773
  3. 3fastspeech2_conformer+1,739 in 7D6,197
  4. 4fastspeech2_conformer_with_hifigan+1,583 in 7D5,820
  5. 5voxcelebs12_rawnet3+1,281 in 7D3,909
  6. 6kamo-naoyuki-mini_an4_asr_train_raw_bpe_valid.acc.best+707 in 7D1,741
  7. 7kan-bayashi_ljspeech_vits+52 in 7D95
  8. 8xeus+17 in 7D90

Recently updated

  1. 1must_c_esp2_st_train_st_conformerSep 24, 20265
  2. 2must_c_st_train_st_conformerSep 24, 20269
  3. 3meld_esp2_cls_wavlm_base_plusSep 21, 202614
  4. 4multi-talker-whisper-small-amiSep 20, 202653
  5. 5anogkongda_librimix_enh_train_raw_valid.si_snr.aveSep 20, 202619
  6. 6dns_icassp21_enh_train_enh_tcn_tf_rawSep 20, 202612
  7. 7chenda-li-wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.aveSep 20, 202614
  8. 8anogkongda-librimix_enh_train_raw_valid.si_snr.aveSep 20, 202615
  9. 9Chenda_Li_wsj0_2mix_enh_train_enh_conv_tasnet_raw_valid.si_snr.aveSep 20, 202617
  10. 10tedlium2_streaming_transformerSep 20, 202621

All models

All tracked models published by espnet
ModelDL 30D7D
kan-bayashi_vctk_gst_xvector_conformer_fastspeech2espnet/kan-bayashi_vctk_gst_xvector_conformer_fastspeech27—
juice500ml_mls_10h_discrete_asrespnet/juice500ml_mls_10h_discrete_asr7—
kan-bayashi_vctk_gst_fastspeech2espnet/kan-bayashi_vctk_gst_fastspeech26—
OpenBEATS-Large-i2-fsd50kespnet/openbeats-large-i2-fsd50k6—
thai_commonvoice_blstmespnet/thai_commonvoice_blstm6—
OpenBEATS-Large-NsynthInstrumentespnet/openbeats-large-nsynthinstrument6—
owls_4B_180K_intermediatesespnet/owls_4b_180k_intermediates6—
ftshijt_espnet2_asr_dsing_hubert_conformerespnet/ftshijt_espnet2_asr_dsing_hubert_conformer6—
kamo-naoyuki_librispeech_asr_train_asr_conformer5_raw_bpe5000_frontend-truncated-b76af5espnet/kamo-naoyuki_librispeech_asr_train_asr_conformer5_raw_bpe5000_frontend-truncated-b76af56—
DCASE23.AudioCaptioning.PreTrainedespnet/dcase23.audiocaptioning.pretrained6—
aaf_openslr57espnet/aaf_openslr576—
espnet_cvhubertespnet/espnet_cvhubert6—
simpleoier_librimix_asr_train_asr_transformer_multispkr_raw_en_char_spespnet/simpleoier_librimix_asr_train_asr_transformer_multispkr_raw_en_char_sp6—
speechlm_unified_v1_1.7Bespnet/speechlm_unified_v1_1.7b6—
libriheavy_small_ebranchformerespnet/libriheavy_small_ebranchformer6—
kan-bayashi_vctk_gst_conformer_fastspeech2espnet/kan-bayashi_vctk_gst_conformer_fastspeech26—
greek_commonvoice_blstmespnet/greek_commonvoice_blstm6—
GunnarThor_talromur_h_tacotron2espnet/gunnarthor_talromur_h_tacotron26—
GunnarThor_talromur_a_tacotron2espnet/gunnarthor_talromur_a_tacotron26—
simpleoier_librispeech_hubert_iter1_train_ssl_torchaudiohubert_base_960h_pretrain_it1_rawespnet/simpleoier_librispeech_hubert_iter1_train_ssl_torchaudiohubert_base_960h_pretrain_it1_raw6—
ofuton_p_utagoe_db_svs_visingerespnet/ofuton_p_utagoe_db_svs_visinger6—
GunnarThor_talromur_h_fastspeech2espnet/gunnarthor_talromur_h_fastspeech26—
dac_44k_all_surveyespnet/dac_44k_all_survey6—
tamil_commonvoice_blstmespnet/tamil_commonvoice_blstm6—
GunnarThor_talromur_d_tacotron2espnet/gunnarthor_talromur_d_tacotron26—