IITKGP-ABSP Submission to LRE22: Language Recognition in Low-Resource Settings
Fuente:
arXiv
Guardado en:
| Autores principales: | Dey, Spandan, Sahidullah, Md, Saha, Goutam |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ChildAugment: Data Augmentation Methods for Zero-Resource Children's Speaker Verification
por: Singh, Vishwanath Pratap, et al.
Publicado: (2024)
por: Singh, Vishwanath Pratap, et al.
Publicado: (2024)
TCG CREST System Description for the Second DISPLACE Challenge
por: Raghav, Nikhil, et al.
Publicado: (2024)
por: Raghav, Nikhil, et al.
Publicado: (2024)
Explaining Speaker and Spoof Embeddings via Probing
por: Liu, Xuechen, et al.
Publicado: (2024)
por: Liu, Xuechen, et al.
Publicado: (2024)
Causal Structure Discovery for Error Diagnostics of Children's ASR
por: Singh, Vishwanath Pratap, et al.
Publicado: (2025)
por: Singh, Vishwanath Pratap, et al.
Publicado: (2025)
MK-SGC-SC: Multiple Kernel Guided Sparse Graph Construction in Spectral Clustering for Unsupervised Speaker Diarization
por: Raghav, Nikhil, et al.
Publicado: (2026)
por: Raghav, Nikhil, et al.
Publicado: (2026)
Exploring Green AI for Audio Deepfake Detection
por: Saha, Subhajit, et al.
Publicado: (2024)
por: Saha, Subhajit, et al.
Publicado: (2024)
Investigation of Deep Neural Network Acoustic Modelling Approaches for Low Resource Accented Mandarin Speech Recognition
por: Xie, Xurong, et al.
Publicado: (2022)
por: Xie, Xurong, et al.
Publicado: (2022)
Zero Shot Text to Speech Augmentation for Automatic Speech Recognition on Low-Resource Accented Speech Corpora
por: Nespoli, Francesco, et al.
Publicado: (2024)
por: Nespoli, Francesco, et al.
Publicado: (2024)
Towards Building Speech Large Language Models for Multitask Understanding in Low-Resource Languages
por: Shao, Mingchen, et al.
Publicado: (2025)
por: Shao, Mingchen, et al.
Publicado: (2025)
Leveraging AM and FM Rhythm Spectrograms for Dementia Classification and Assessment
por: Gogoi, Parismita, et al.
Publicado: (2025)
por: Gogoi, Parismita, et al.
Publicado: (2025)
AC-Mix: Self-Supervised Adaptation for Low-Resource Automatic Speech Recognition using Agnostic Contrastive Mixup
por: Carvalho, Carlos, et al.
Publicado: (2024)
por: Carvalho, Carlos, et al.
Publicado: (2024)
Self-Tuning Spectral Clustering for Speaker Diarization
por: Raghav, Nikhil, et al.
Publicado: (2024)
por: Raghav, Nikhil, et al.
Publicado: (2024)
Methods to Increase the Amount of Data for Speech Recognition for Low Resource Languages
por: Ayrapetyan, Alexan, et al.
Publicado: (2025)
por: Ayrapetyan, Alexan, et al.
Publicado: (2025)
Weighted Cross-entropy for Low-Resource Languages in Multilingual Speech Recognition
por: Piñeiro-Martín, Andrés, et al.
Publicado: (2024)
por: Piñeiro-Martín, Andrés, et al.
Publicado: (2024)
When Spoof Detectors Travel: Evaluation Across 66 Languages in the Low-Resource Language Spoofing Corpus
por: Borodin, Kirill, et al.
Publicado: (2026)
por: Borodin, Kirill, et al.
Publicado: (2026)
Multimodal Zero-Shot Framework for Deepfake Hate Speech Detection in Low-Resource Languages
por: Ranjan, Rishabh, et al.
Publicado: (2025)
por: Ranjan, Rishabh, et al.
Publicado: (2025)
Improving Rare-Word Recognition of Whisper in Zero-Shot Settings
por: Jogi, Yash, et al.
Publicado: (2025)
por: Jogi, Yash, et al.
Publicado: (2025)
Automatic Speech Recognition for African Low-Resource Languages: Challenges and Future Directions
por: Imam, Sukairaj Hafiz, et al.
Publicado: (2025)
por: Imam, Sukairaj Hafiz, et al.
Publicado: (2025)
Machine Unlearning in Speech Emotion Recognition via Forget Set Alone
por: Ren, Zhao, et al.
Publicado: (2025)
por: Ren, Zhao, et al.
Publicado: (2025)
Hybrid Deep Learning and Signal Processing for Arabic Dialect Recognition in Low-Resource Settings
por: Al-Shwayyat, Ghazal, et al.
Publicado: (2025)
por: Al-Shwayyat, Ghazal, et al.
Publicado: (2025)
Beyond Silence: Bias Analysis through Loss and Asymmetric Approach in Audio Anti-Spoofing
por: Shim, Hye-jin, et al.
Publicado: (2024)
por: Shim, Hye-jin, et al.
Publicado: (2024)
SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition
por: Hsu, Ming-Hao, et al.
Publicado: (2024)
por: Hsu, Ming-Hao, et al.
Publicado: (2024)
Assessing the Robustness of Spectral Clustering for Deep Speaker Diarization
por: Raghav, Nikhil, et al.
Publicado: (2024)
por: Raghav, Nikhil, et al.
Publicado: (2024)
Improving Acoustic Scene Classification in Low-Resource Conditions
por: Chen, Zhi, et al.
Publicado: (2024)
por: Chen, Zhi, et al.
Publicado: (2024)
FMSG-JLESS Submission for DCASE 2024 Task4 on Sound Event Detection with Heterogeneous Training Dataset and Potentially Missing Labels
por: Xiao, Yang, et al.
Publicado: (2024)
por: Xiao, Yang, et al.
Publicado: (2024)
Towards Inclusive ASR: Investigating Voice Conversion for Dysarthric Speech Recognition in Low-Resource Languages
por: Li, Chin-Jou, et al.
Publicado: (2025)
por: Li, Chin-Jou, et al.
Publicado: (2025)
Low-Resource Audio Codec (LRAC): 2025 Challenge Description
por: Wojcicki, Kamil, et al.
Publicado: (2025)
por: Wojcicki, Kamil, et al.
Publicado: (2025)
Low-Resource Self-Supervised Learning with SSL-Enhanced TTS
por: Hsu, Po-chun, et al.
Publicado: (2023)
por: Hsu, Po-chun, et al.
Publicado: (2023)
oboVox Far Field Speaker Recognition: A Novel Data Augmentation Approach with Pretrained Models
por: Dip, Muhammad Sudipto Siam, et al.
Publicado: (2024)
por: Dip, Muhammad Sudipto Siam, et al.
Publicado: (2024)
Comparative Analysis Of Discriminative Deep Learning-Based Noise Reduction Methods In Low SNR Scenarios
por: Shetu, Shrishti Saha, et al.
Publicado: (2024)
por: Shetu, Shrishti Saha, et al.
Publicado: (2024)
Adapting Where It Matters: Depth-Aware Adaptation for Efficient Multilingual Speech Recognition in Low-Resource Languages
por: Xiao, Yang, et al.
Publicado: (2026)
por: Xiao, Yang, et al.
Publicado: (2026)
Automatic Speech Recognition for Biomedical Data in Bengali Language
por: Kabir, Shariar, et al.
Publicado: (2024)
por: Kabir, Shariar, et al.
Publicado: (2024)
PhoenixCodec: Taming Neural Speech Coding for Extreme Low-Resource Scenarios
por: Wan, Zixiang, et al.
Publicado: (2025)
por: Wan, Zixiang, et al.
Publicado: (2025)
Zero-Shot Recognition of Dysarthric Speech Using Commercial Automatic Speech Recognition and Multimodal Large Language Models
por: Alsayegh, Ali, et al.
Publicado: (2025)
por: Alsayegh, Ali, et al.
Publicado: (2025)
Low-Resourced Speech Recognition for Iu Mien Language via Weakly-Supervised Phoneme-based Multilingual Pre-training
por: Dong, Lukuan, et al.
Publicado: (2024)
por: Dong, Lukuan, et al.
Publicado: (2024)
A Hybrid Approach for Low-Complexity Joint Acoustic Echo and Noise Reduction
por: Shetu, Shrishti Saha, et al.
Publicado: (2024)
por: Shetu, Shrishti Saha, et al.
Publicado: (2024)
SOA: Reducing Domain Mismatch in SSL Pipeline by Speech Only Adaptation for Low Resource ASR
por: Shankar, Natarajan Balaji, et al.
Publicado: (2024)
por: Shankar, Natarajan Balaji, et al.
Publicado: (2024)
Audio-Based Linguistic Feature Extraction for Enhancing Multi-lingual and Low-Resource Text-to-Speech
por: Kim, Youngjae, et al.
Publicado: (2024)
por: Kim, Youngjae, et al.
Publicado: (2024)
Generalizing Speaker Verification for Spoof Awareness in the Embedding Space
por: Liu, Xuechen, et al.
Publicado: (2024)
por: Liu, Xuechen, et al.
Publicado: (2024)
Automatic Speech Recognition for Hindi
por: Saha, Anish, et al.
Publicado: (2024)
por: Saha, Anish, et al.
Publicado: (2024)
Ejemplares similares
-
ChildAugment: Data Augmentation Methods for Zero-Resource Children's Speaker Verification
por: Singh, Vishwanath Pratap, et al.
Publicado: (2024) -
TCG CREST System Description for the Second DISPLACE Challenge
por: Raghav, Nikhil, et al.
Publicado: (2024) -
Explaining Speaker and Spoof Embeddings via Probing
por: Liu, Xuechen, et al.
Publicado: (2024) -
Causal Structure Discovery for Error Diagnostics of Children's ASR
por: Singh, Vishwanath Pratap, et al.
Publicado: (2025) -
MK-SGC-SC: Multiple Kernel Guided Sparse Graph Construction in Spectral Clustering for Unsupervised Speaker Diarization
por: Raghav, Nikhil, et al.
Publicado: (2026)