A new arXiv study finds that pretrained self-supervised speech models like Wav2Vec2 and HuBERT, despite training data skewed toward high-resource languages, can recognize click consonants from Khoisan languages…
#AI #SpeechRecognition #NLP #LowResourceLanguages
https://arxiv.org/abs/2606.11542
