Can I use this model to train/finetune an audio classifier (Speech-to-label)?
Can I use this model to train/finetune an audio classifier (Speech-to-label)?