LongCat-AudioDiT-3.5B-bf16

drbaph/LongCat-AudioDiT-3.5B-bf16

Text to Speech3.8B parameterstransformersLicense: mit
Tracked by OpenModelStats since September 27, 2026View on Hugging Face ↗
Downloads 30D
5,680
Total downloads
17.9K
Gained 7D
+78(increase)
0.4%(up) vs baseline
Gained 30D
—
Likes
6
+0 in 7D
Rank · tracked models
#10,925
46(up 46 places)this week
Parameters
3.8B
Last source update
Mar 30, 2026
Momentum
30.0
  • LongCat-AudioDiT-3.5B-bf16 gained 78 downloads during the last seven tracked days.
  • It moved from #133 to #132 among tracked Text to Speech models this week.

Downloads over time

Cumulative total downloads observed by OpenModelStats

Likes over time

Rank among tracked models

Lower is better

Overview

LongCat-AudioDiT-3.5B-bf16 is a text to speech model published by drbaph. OpenModelStats has tracked the model since Sep 27, 2026, most recently observing it Sep 28, 2026.

Published
Mar 30, 2026
Last updated
Mar 30, 2026
Library
transformers
License
mit
Task
Text to Speech
Parameters
3,833,985,217
Spaces
—
Derivative models
—
Velocity 7D/day
11
transformerssafetensorsaudioditcomfyuitext-to-speechzhenlicense:mitendpoints_compatibleregion:us

Similar models

Models similar to LongCat-AudioDiT-3.5B-bf16
ModelDL 30D
Veenamaya-research4,071
orpheus-3b-0.1-ftcanopylabs29.9K
orpheus-3b-0.1-ftjetjodh5,316
aava-tts-persian-3bKEYHAN-A3,309
orpheus-3b-0.1-ftaudo2,135
orpheus-3b-0.1-pretrainedcanopylabs2,130