Speech Recognition Transformers: Topological-lingualism Perspective
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Singh, Shruti, Singh, Muskaan, Kadyan, Virender |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cross-lingual Embedding Clustering for Hierarchical Softmax in Low-Resource Multilingual Speech Recognition
par: Yang, Zhengdong, et autres
Publié: (2025)
par: Yang, Zhengdong, et autres
Publié: (2025)
Voice of India: A Large-Scale Benchmark for Real-World Speech Recognition in India
par: Bhogale, Kaushal, et autres
Publié: (2026)
par: Bhogale, Kaushal, et autres
Publié: (2026)
Adapting Self-Supervised Speech Representations for Cross-lingual Dysarthria Detection in Parkinson's Disease
par: Hernandez, Abner, et autres
Publié: (2026)
par: Hernandez, Abner, et autres
Publié: (2026)
Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
par: Zhang, Zixing, et autres
Publié: (2024)
par: Zhang, Zixing, et autres
Publié: (2024)
What Do Speech Foundation Models Not Learn About Speech?
par: Waheed, Abdul, et autres
Publié: (2024)
par: Waheed, Abdul, et autres
Publié: (2024)
DIVINE: Coordinating Multimodal Disentangled Representations for Oro-Facial Neurological Disorder Assessment
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2026)
par: Akhtar, Mohd Mujtaba, et autres
Publié: (2026)
Benchmarking Automatic Speech Recognition for Indian Languages in Agricultural Contexts
par: S, Chandrashekar M, et autres
Publié: (2026)
par: S, Chandrashekar M, et autres
Publié: (2026)
Automatic Speech Recognition for Hindi
par: Saha, Anish, et autres
Publié: (2024)
par: Saha, Anish, et autres
Publié: (2024)
Leveraging Cross-Attention Transformer and Multi-Feature Fusion for Cross-Linguistic Speech Emotion Recognition
par: Zhao, Ruoyu, et autres
Publié: (2025)
par: Zhao, Ruoyu, et autres
Publié: (2025)
Speech Recognition Rescoring with Large Speech-Text Foundation Models
par: Shivakumar, Prashanth Gurunath, et autres
Publié: (2024)
par: Shivakumar, Prashanth Gurunath, et autres
Publié: (2024)
Joint Automatic Speech Recognition And Structure Learning For Better Speech Understanding
par: Hu, Jiliang, et autres
Publié: (2025)
par: Hu, Jiliang, et autres
Publié: (2025)
Inappropriate Pause Detection In Dysarthric Speech Using Large-Scale Speech Recognition
par: Lee, Jeehyun, et autres
Publié: (2024)
par: Lee, Jeehyun, et autres
Publié: (2024)
Generating Data with Text-to-Speech and Large-Language Models for Conversational Speech Recognition
par: Cornell, Samuele, et autres
Publié: (2024)
par: Cornell, Samuele, et autres
Publié: (2024)
Swedish Whispers; Leveraging a Massive Speech Corpus for Swedish Speech Recognition
par: Vesterbacka, Leonora, et autres
Publié: (2025)
par: Vesterbacka, Leonora, et autres
Publié: (2025)
Exploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition
par: Wang, Yujin, et autres
Publié: (2022)
par: Wang, Yujin, et autres
Publié: (2022)
Dynamic Data Pruning for Automatic Speech Recognition
par: Xiao, Qiao, et autres
Publié: (2024)
par: Xiao, Qiao, et autres
Publié: (2024)
Contextualized Automatic Speech Recognition with Dynamic Vocabulary
par: Sudo, Yui, et autres
Publié: (2024)
par: Sudo, Yui, et autres
Publié: (2024)
Dialectal Coverage And Generalization in Arabic Speech Recognition
par: Djanibekov, Amirbek, et autres
Publié: (2024)
par: Djanibekov, Amirbek, et autres
Publié: (2024)
On the Contribution of Lexical Features to Speech Emotion Recognition
par: Combei, David
Publié: (2025)
par: Combei, David
Publié: (2025)
Unimodal Aggregation for CTC-based Speech Recognition
par: Fang, Ying, et autres
Publié: (2023)
par: Fang, Ying, et autres
Publié: (2023)
Continual Adaptation for Pacific Indigenous Speech Recognition
par: Xiao, Yang, et autres
Publié: (2026)
par: Xiao, Yang, et autres
Publié: (2026)
Improving Speech Emotion Recognition in Under-Resourced Languages via Speech-to-Speech Translation with Bootstrapping Data Selection
par: Lin, Hsi-Che, et autres
Publié: (2024)
par: Lin, Hsi-Che, et autres
Publié: (2024)
Enhancing Indonesian Automatic Speech Recognition: Evaluating Multilingual Models with Diverse Speech Variabilities
par: Adila, Aulia, et autres
Publié: (2024)
par: Adila, Aulia, et autres
Publié: (2024)
SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition
par: Hsu, Ming-Hao, et autres
Publié: (2024)
par: Hsu, Ming-Hao, et autres
Publié: (2024)
Are Paralinguistic Representations all that is needed for Speech Emotion Recognition?
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
Exploration of Adapter for Noise Robust Automatic Speech Recognition
par: Shi, Hao, et autres
Publié: (2024)
par: Shi, Hao, et autres
Publié: (2024)
Towards Unsupervised Speech Recognition Without Pronunciation Models
par: Ni, Junrui, et autres
Publié: (2024)
par: Ni, Junrui, et autres
Publié: (2024)
Sequential Editing for Lifelong Training of Speech Recognition Models
par: Kulshreshtha, Devang, et autres
Publié: (2024)
par: Kulshreshtha, Devang, et autres
Publié: (2024)
Automatic Speech Recognition for Biomedical Data in Bengali Language
par: Kabir, Shariar, et autres
Publié: (2024)
par: Kabir, Shariar, et autres
Publié: (2024)
Children's Speech Recognition through Discrete Token Enhancement
par: Sukhadia, Vrunda N., et autres
Publié: (2024)
par: Sukhadia, Vrunda N., et autres
Publié: (2024)
Weight Factorization and Centralization for Continual Learning in Speech Recognition
par: Ugan, Enes Yavuz, et autres
Publié: (2025)
par: Ugan, Enes Yavuz, et autres
Publié: (2025)
Benchmarking Automatic Speech Recognition Models for African Languages
par: Nahabwe, Alvin, et autres
Publié: (2025)
par: Nahabwe, Alvin, et autres
Publié: (2025)
Frontend Token Enhancement for Token-Based Speech Recognition
par: Ashihara, Takanori, et autres
Publié: (2026)
par: Ashihara, Takanori, et autres
Publié: (2026)
Retrieval-Augmented Speech Recognition Approach for Domain Challenges
par: Shen, Peng, et autres
Publié: (2025)
par: Shen, Peng, et autres
Publié: (2025)
Speaker-Aware Simulation Improves Conversational Speech Recognition
par: Gedeon, Máté, et autres
Publié: (2026)
par: Gedeon, Máté, et autres
Publié: (2026)
Exploring Gender Disparities in Automatic Speech Recognition Technology
par: ElGhazaly, Hend, et autres
Publié: (2025)
par: ElGhazaly, Hend, et autres
Publié: (2025)
Improving Accented Speech Recognition using Data Augmentation based on Unsupervised Text-to-Speech Synthesis
par: Do, Cong-Thanh, et autres
Publié: (2024)
par: Do, Cong-Thanh, et autres
Publié: (2024)
Transformers in Speech Processing: A Survey
par: Latif, Siddique, et autres
Publié: (2023)
par: Latif, Siddique, et autres
Publié: (2023)
PSST! Prosodic Speech Segmentation with Transformers
par: Roll, Nathan, et autres
Publié: (2023)
par: Roll, Nathan, et autres
Publié: (2023)
STAB: Speech Tokenizer Assessment Benchmark
par: Vashishth, Shikhar, et autres
Publié: (2024)
par: Vashishth, Shikhar, et autres
Publié: (2024)
Documents similaires
-
Cross-lingual Embedding Clustering for Hierarchical Softmax in Low-Resource Multilingual Speech Recognition
par: Yang, Zhengdong, et autres
Publié: (2025) -
Voice of India: A Large-Scale Benchmark for Real-World Speech Recognition in India
par: Bhogale, Kaushal, et autres
Publié: (2026) -
Adapting Self-Supervised Speech Representations for Cross-lingual Dysarthria Detection in Parkinson's Disease
par: Hernandez, Abner, et autres
Publié: (2026) -
Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
par: Zhang, Zixing, et autres
Publié: (2024) -
What Do Speech Foundation Models Not Learn About Speech?
par: Waheed, Abdul, et autres
Publié: (2024)