Joint vs Sequential Speaker-Role Detection and Automatic Speech Recognition for Air-traffic Control
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Blatt, Alexander, Krishnan, Aravind, Klakow, Dietrich |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Less Stress, More Privacy: Stress Detection on Anonymized Speech of Air Traffic Controllers
par: Viswanathan, Janaki, et autres
Publié: (2025)
par: Viswanathan, Janaki, et autres
Publié: (2025)
Joint Automatic Speech Recognition And Structure Learning For Better Speech Understanding
par: Hu, Jiliang, et autres
Publié: (2025)
par: Hu, Jiliang, et autres
Publié: (2025)
Automatic Speech Recognition for Hindi
par: Saha, Anish, et autres
Publié: (2024)
par: Saha, Anish, et autres
Publié: (2024)
Pitch Accent Detection improves Pretrained Automatic Speech Recognition
par: Sasu, David, et autres
Publié: (2025)
par: Sasu, David, et autres
Publié: (2025)
Speaker-Aware Simulation Improves Conversational Speech Recognition
par: Gedeon, Máté, et autres
Publié: (2026)
par: Gedeon, Máté, et autres
Publié: (2026)
Joint Optimization of Streaming and Non-Streaming Automatic Speech Recognition with Multi-Decoder and Knowledge Distillation
par: Shakeel, Muhammad, et autres
Publié: (2024)
par: Shakeel, Muhammad, et autres
Publié: (2024)
Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition
par: Sakuma, Asahi, et autres
Publié: (2025)
par: Sakuma, Asahi, et autres
Publié: (2025)
Dynamic Data Pruning for Automatic Speech Recognition
par: Xiao, Qiao, et autres
Publié: (2024)
par: Xiao, Qiao, et autres
Publié: (2024)
Contextualized Automatic Speech Recognition with Dynamic Vocabulary
par: Sudo, Yui, et autres
Publié: (2024)
par: Sudo, Yui, et autres
Publié: (2024)
Sequential Editing for Lifelong Training of Speech Recognition Models
par: Kulshreshtha, Devang, et autres
Publié: (2024)
par: Kulshreshtha, Devang, et autres
Publié: (2024)
AfriHuBERT: A self-supervised speech representation model for African languages
par: Alabi, Jesujoba O., et autres
Publié: (2024)
par: Alabi, Jesujoba O., et autres
Publié: (2024)
Voice Conversion Improves Cross-Domain Robustness for Spoken Arabic Dialect Identification
par: Abdullah, Badr M., et autres
Publié: (2025)
par: Abdullah, Badr M., et autres
Publié: (2025)
Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio
par: He, Xinlu, et autres
Publié: (2025)
par: He, Xinlu, et autres
Publié: (2025)
Hypothesis Clustering and Merging: Novel MultiTalker Speech Recognition with Speaker Tokens
par: Kashiwagi, Yosuke, et autres
Publié: (2024)
par: Kashiwagi, Yosuke, et autres
Publié: (2024)
Enhancing Dysarthric Speech Recognition for Unseen Speakers via Prototype-Based Adaptation
par: Wang, Shiyao, et autres
Publié: (2024)
par: Wang, Shiyao, et autres
Publié: (2024)
Exploration of Adapter for Noise Robust Automatic Speech Recognition
par: Shi, Hao, et autres
Publié: (2024)
par: Shi, Hao, et autres
Publié: (2024)
Automatic Speech Recognition for Biomedical Data in Bengali Language
par: Kabir, Shariar, et autres
Publié: (2024)
par: Kabir, Shariar, et autres
Publié: (2024)
Benchmarking Automatic Speech Recognition Models for African Languages
par: Nahabwe, Alvin, et autres
Publié: (2025)
par: Nahabwe, Alvin, et autres
Publié: (2025)
Exploring Gender Disparities in Automatic Speech Recognition Technology
par: ElGhazaly, Hend, et autres
Publié: (2025)
par: ElGhazaly, Hend, et autres
Publié: (2025)
Exploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition
par: Wang, Yujin, et autres
Publié: (2022)
par: Wang, Yujin, et autres
Publié: (2022)
Investigation of Speaker Representation for Target-Speaker Speech Processing
par: Ashihara, Takanori, et autres
Publié: (2024)
par: Ashihara, Takanori, et autres
Publié: (2024)
Gammatonegram Representation for End-to-End Dysarthric Speech Processing Tasks: Speech Recognition, Speaker Identification, and Intelligibility Assessment
par: Farhadipour, Aref, et autres
Publié: (2023)
par: Farhadipour, Aref, et autres
Publié: (2023)
Evaluating Automatic Speech Recognition Systems for Korean Meteorological Experts
par: Park, ChaeHun, et autres
Publié: (2024)
par: Park, ChaeHun, et autres
Publié: (2024)
Convolutional Variational Autoencoders for Spectrogram Compression in Automatic Speech Recognition
par: Iakovenko, Olga, et autres
Publié: (2024)
par: Iakovenko, Olga, et autres
Publié: (2024)
Transliterated Zero-Shot Domain Adaptation for Automatic Speech Recognition
par: Zhu, Han, et autres
Publié: (2024)
par: Zhu, Han, et autres
Publié: (2024)
UCorrect: An Unsupervised Framework for Automatic Speech Recognition Error Correction
par: Guo, Jiaxin, et autres
Publié: (2024)
par: Guo, Jiaxin, et autres
Publié: (2024)
Supporting SENCOTEN Language Documentation Efforts with Automatic Speech Recognition
par: Geng, Mengzhe, et autres
Publié: (2025)
par: Geng, Mengzhe, et autres
Publié: (2025)
Word Level Timestamp Generation for Automatic Speech Recognition and Translation
par: Hu, Ke, et autres
Publié: (2025)
par: Hu, Ke, et autres
Publié: (2025)
Contextualized Automatic Speech Recognition with Dynamic Vocabulary Prediction and Activation
par: Lin, Zhennan, et autres
Publié: (2025)
par: Lin, Zhennan, et autres
Publié: (2025)
Enhancing Indonesian Automatic Speech Recognition: Evaluating Multilingual Models with Diverse Speech Variabilities
par: Adila, Aulia, et autres
Publié: (2024)
par: Adila, Aulia, et autres
Publié: (2024)
SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition
par: Hsu, Ming-Hao, et autres
Publié: (2024)
par: Hsu, Ming-Hao, et autres
Publié: (2024)
Two-stage Framework for Robust Speech Emotion Recognition Using Target Speaker Extraction in Human Speech Noise Conditions
par: Mi, Jinyi, et autres
Publié: (2024)
par: Mi, Jinyi, et autres
Publié: (2024)
In-Context Learning Boosts Speech Recognition via Human-like Adaptation to Speakers and Language Varieties
par: Roll, Nathan, et autres
Publié: (2025)
par: Roll, Nathan, et autres
Publié: (2025)
SC-SOT: Conditioning the Decoder on Diarized Speaker Information for End-to-End Overlapped Speech Recognition
par: Hirano, Yuta, et autres
Publié: (2025)
par: Hirano, Yuta, et autres
Publié: (2025)
Automatic Speech Recognition System-Independent Word Error Rate Estimation
par: Park, Chanho, et autres
Publié: (2024)
par: Park, Chanho, et autres
Publié: (2024)
Hallucinations in Neural Automatic Speech Recognition: Identifying Errors and Hallucinatory Models
par: Frieske, Rita, et autres
Publié: (2024)
par: Frieske, Rita, et autres
Publié: (2024)
Contextualized End-to-end Automatic Speech Recognition with Intermediate Biasing Loss
par: Shakeel, Muhammad, et autres
Publié: (2024)
par: Shakeel, Muhammad, et autres
Publié: (2024)
Sagalee: an Open Source Automatic Speech Recognition Dataset for Oromo Language
par: Abu, Turi, et autres
Publié: (2025)
par: Abu, Turi, et autres
Publié: (2025)
Automatic Speech Recognition for Non-Native English: Accuracy and Disfluency Handling
par: McGuire, Michael
Publié: (2025)
par: McGuire, Michael
Publié: (2025)
A Deep Learning Automatic Speech Recognition Model for Shona Language
par: Sirora, Leslie Wellington, et autres
Publié: (2025)
par: Sirora, Leslie Wellington, et autres
Publié: (2025)
Documents similaires
-
Less Stress, More Privacy: Stress Detection on Anonymized Speech of Air Traffic Controllers
par: Viswanathan, Janaki, et autres
Publié: (2025) -
Joint Automatic Speech Recognition And Structure Learning For Better Speech Understanding
par: Hu, Jiliang, et autres
Publié: (2025) -
Automatic Speech Recognition for Hindi
par: Saha, Anish, et autres
Publié: (2024) -
Pitch Accent Detection improves Pretrained Automatic Speech Recognition
par: Sasu, David, et autres
Publié: (2025) -
Speaker-Aware Simulation Improves Conversational Speech Recognition
par: Gedeon, Máté, et autres
Publié: (2026)