Models I'm curious about and would like to try as soon as I have time.
-
nari-labs/Dia-1.6B
Text-to-Speech • 2B • Updated • 30.5k • • 2.91k -
nvidia/parakeet-tdt-0.6b-v2
Automatic Speech Recognition • Updated • 269k • 1.54k -
lusxvr/nanoVLM-222M
Image-Text-to-Text • 0.2B • Updated • 1.34k • 103 -
canopylabs/orpheus-3b-0.1-pretrained
Text-to-Speech • 4B • Updated • 2.02k • • 172