WhisperPipe: A Resource-Efficient Streaming Architecture for Real-Time Automatic Speech Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ramezani, Erfan, Giahi, Mohammad Mahdi, Zarabadipour, Mohammad Erfan, Yosefian, Amir Reza, Ghadiri, Hamid |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Uni-ASR: Unified LLM-Based Architecture for Non-Streaming and Streaming Automatic Speech Recognition
par: Xia, Yinfeng, et autres
Publié: (2026)
par: Xia, Yinfeng, et autres
Publié: (2026)
PI-Whisper: Designing an Adaptive and Incremental Automatic Speech Recognition System for Edge Devices
par: Nassereldine, Amir, et autres
Publié: (2024)
par: Nassereldine, Amir, et autres
Publié: (2024)
ASKD-Whisper: Adaptive Self-knowledge Distillation for Efficient and Low-Latency Automatic Speech Recognition
par: Lee, Junseok, et autres
Publié: (2026)
par: Lee, Junseok, et autres
Publié: (2026)
Probing Whisper for Dysarthric Speech in Detection and Assessment
par: Yue, Zhengjun, et autres
Publié: (2025)
par: Yue, Zhengjun, et autres
Publié: (2025)
OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary
par: Sudo, Yui, et autres
Publié: (2025)
par: Sudo, Yui, et autres
Publié: (2025)
DQ-Whisper: Joint Distillation and Quantization for Efficient Multilingual Speech Recognition
par: Shao, Hang, et autres
Publié: (2023)
par: Shao, Hang, et autres
Publié: (2023)
Kid-Whisper: Towards Bridging the Performance Gap in Automatic Speech Recognition for Children VS. Adults
par: Attia, Ahmed Adel, et autres
Publié: (2023)
par: Attia, Ahmed Adel, et autres
Publié: (2023)
Joint Optimization of Streaming and Non-Streaming Automatic Speech Recognition with Multi-Decoder and Knowledge Distillation
par: Shakeel, Muhammad, et autres
Publié: (2024)
par: Shakeel, Muhammad, et autres
Publié: (2024)
Accent-Invariant Automatic Speech Recognition via Saliency-Driven Spectrogram Masking
par: Sameti, Mohammad Hossein, et autres
Publié: (2025)
par: Sameti, Mohammad Hossein, et autres
Publié: (2025)
Swedish Whispers; Leveraging a Massive Speech Corpus for Swedish Speech Recognition
par: Vesterbacka, Leonora, et autres
Publié: (2025)
par: Vesterbacka, Leonora, et autres
Publié: (2025)
Efficient Streaming LLM for Speech Recognition
par: Jia, Junteng, et autres
Publié: (2024)
par: Jia, Junteng, et autres
Publié: (2024)
Simul-Whisper: Attention-Guided Streaming Whisper with Truncation Detection
par: Wang, Haoyu, et autres
Publié: (2024)
par: Wang, Haoyu, et autres
Publié: (2024)
SMILE: Speech Meta In-Context Learning for Low-Resource Language Automatic Speech Recognition
par: Hsu, Ming-Hao, et autres
Publié: (2024)
par: Hsu, Ming-Hao, et autres
Publié: (2024)
Speech ReaLLM -- Real-time Streaming Speech Recognition with Multimodal LLMs by Teaching the Flow of Time
par: Seide, Frank, et autres
Publié: (2024)
par: Seide, Frank, et autres
Publié: (2024)
CIF-T: A Novel CIF-based Transducer Architecture for Automatic Speech Recognition
par: Zhang, Tian-Hao, et autres
Publié: (2023)
par: Zhang, Tian-Hao, et autres
Publié: (2023)
Automatic Speech Recognition of African American English: Lexical and Contextual Effects
par: Mojarad, Hamid, et autres
Publié: (2025)
par: Mojarad, Hamid, et autres
Publié: (2025)
Automatic Speech Recognition for Hindi
par: Saha, Anish, et autres
Publié: (2024)
par: Saha, Anish, et autres
Publié: (2024)
Adapting Diarization-Conditioned Whisper for End-to-End Multi-Talker Speech Recognition
par: Kocour, Martin, et autres
Publié: (2025)
par: Kocour, Martin, et autres
Publié: (2025)
Automatic Speech Recognition for African Low-Resource Languages: Challenges and Future Directions
par: Imam, Sukairaj Hafiz, et autres
Publié: (2025)
par: Imam, Sukairaj Hafiz, et autres
Publié: (2025)
Leveraging Self-Supervised Models for Automatic Whispered Speech Recognition
par: Farhadipour, Aref, et autres
Publié: (2024)
par: Farhadipour, Aref, et autres
Publié: (2024)
Improving the Inclusivity of Dutch Speech Recognition by Fine-tuning Whisper on the JASMIN-CGN Corpus
par: Shekoufandeh, Golshid, et autres
Publié: (2025)
par: Shekoufandeh, Golshid, et autres
Publié: (2025)
Empowering Whisper as a Joint Multi-Talker and Target-Talker Speech Recognition System
par: Meng, Lingwei, et autres
Publié: (2024)
par: Meng, Lingwei, et autres
Publié: (2024)
CLASP: Contrastive Language-Speech Pretraining for Multilingual Multimodal Information Retrieval
par: Abootorabi, Mohammad Mahdi, et autres
Publié: (2024)
par: Abootorabi, Mohammad Mahdi, et autres
Publié: (2024)
WhisperRT -- Turning Whisper into a Causal Streaming Model
par: Krichli, Tomer, et autres
Publié: (2025)
par: Krichli, Tomer, et autres
Publié: (2025)
Improving Whisper's Recognition Performance for Under-Represented Language Kazakh Leveraging Unpaired Speech and Text
par: Li, Jinpeng, et autres
Publié: (2024)
par: Li, Jinpeng, et autres
Publié: (2024)
LI-TTA: Language Informed Test-Time Adaptation for Automatic Speech Recognition
par: Yoon, Eunseop, et autres
Publié: (2024)
par: Yoon, Eunseop, et autres
Publié: (2024)
Adapting Whisper for Streaming Speech Recognition via Two-Pass Decoding
par: Zhou, Haoran, et autres
Publié: (2025)
par: Zhou, Haoran, et autres
Publié: (2025)
Huntington Disease Automatic Speech Recognition with Biomarker Supervision
par: Wang, Charles L., et autres
Publié: (2026)
par: Wang, Charles L., et autres
Publié: (2026)
Speech Emotion Recognition Leveraging OpenAI's Whisper Representations and Attentive Pooling Methods
par: Shendabadi, Ali, et autres
Publié: (2026)
par: Shendabadi, Ali, et autres
Publié: (2026)
On the Effect of Purely Synthetic Training Data for Different Automatic Speech Recognition Architectures
par: Hilmes, Benedikt, et autres
Publié: (2024)
par: Hilmes, Benedikt, et autres
Publié: (2024)
Dynamic Data Pruning for Automatic Speech Recognition
par: Xiao, Qiao, et autres
Publié: (2024)
par: Xiao, Qiao, et autres
Publié: (2024)
Contextualized Automatic Speech Recognition with Dynamic Vocabulary
par: Sudo, Yui, et autres
Publié: (2024)
par: Sudo, Yui, et autres
Publié: (2024)
Joint Automatic Speech Recognition And Structure Learning For Better Speech Understanding
par: Hu, Jiliang, et autres
Publié: (2025)
par: Hu, Jiliang, et autres
Publié: (2025)
Benchmarking Automatic Speech Recognition Models for African Languages
par: Nahabwe, Alvin, et autres
Publié: (2025)
par: Nahabwe, Alvin, et autres
Publié: (2025)
Exploration of Adapter for Noise Robust Automatic Speech Recognition
par: Shi, Hao, et autres
Publié: (2024)
par: Shi, Hao, et autres
Publié: (2024)
Exploring Gender Disparities in Automatic Speech Recognition Technology
par: ElGhazaly, Hend, et autres
Publié: (2025)
par: ElGhazaly, Hend, et autres
Publié: (2025)
Automatic Speech Recognition for Biomedical Data in Bengali Language
par: Kabir, Shariar, et autres
Publié: (2024)
par: Kabir, Shariar, et autres
Publié: (2024)
Direct Speech to Speech Translation: A Review
par: Sarim, Mohammad, et autres
Publié: (2025)
par: Sarim, Mohammad, et autres
Publié: (2025)
Exploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition
par: Wang, Yujin, et autres
Publié: (2022)
par: Wang, Yujin, et autres
Publié: (2022)
Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition
par: Gong, Ziwei, et autres
Publié: (2025)
par: Gong, Ziwei, et autres
Publié: (2025)
Documents similaires
-
Uni-ASR: Unified LLM-Based Architecture for Non-Streaming and Streaming Automatic Speech Recognition
par: Xia, Yinfeng, et autres
Publié: (2026) -
PI-Whisper: Designing an Adaptive and Incremental Automatic Speech Recognition System for Edge Devices
par: Nassereldine, Amir, et autres
Publié: (2024) -
ASKD-Whisper: Adaptive Self-knowledge Distillation for Efficient and Low-Latency Automatic Speech Recognition
par: Lee, Junseok, et autres
Publié: (2026) -
Probing Whisper for Dysarthric Speech in Detection and Assessment
par: Yue, Zhengjun, et autres
Publié: (2025) -
OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary
par: Sudo, Yui, et autres
Publié: (2025)