Adaptive Dropout for Pruning Conformers
Fuente:
arXiv
Salvato in:
| Autori principali: | Kubo, Yotaro, Cai, Xingyu, Bacchiani, Michiel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Building Tailored Speech Recognizers for Japanese Speaking Assessment
di: Kubo, Yotaro, et al.
Pubblicazione: (2025)
di: Kubo, Yotaro, et al.
Pubblicazione: (2025)
Miipher-2: A Universal Speech Restoration Model for Million-Hour Scale Data Restoration
di: Karita, Shigeki, et al.
Pubblicazione: (2025)
di: Karita, Shigeki, et al.
Pubblicazione: (2025)
KAME: Tandem Architecture for Enhancing Knowledge in Real-Time Speech-to-Speech Conversational AI
di: Kuroki, So, et al.
Pubblicazione: (2025)
di: Kuroki, So, et al.
Pubblicazione: (2025)
FLEURS-R: A Restored Multilingual Speech Corpus for Generation Tasks
di: Ma, Min, et al.
Pubblicazione: (2024)
di: Ma, Min, et al.
Pubblicazione: (2024)
Pruning as Regularization: Sensitivity-Aware One-Shot Pruning in ASR
di: Irigoyen, Julian, et al.
Pubblicazione: (2025)
di: Irigoyen, Julian, et al.
Pubblicazione: (2025)
Multi-Level Embedding Conformer Framework for Bengali Automatic Speech Recognition
di: Sakib, Md. Nazmus, et al.
Pubblicazione: (2025)
di: Sakib, Md. Nazmus, et al.
Pubblicazione: (2025)
Stateful Conformer with Cache-based Inference for Streaming Automatic Speech Recognition
di: Noroozi, Vahid, et al.
Pubblicazione: (2023)
di: Noroozi, Vahid, et al.
Pubblicazione: (2023)
Convexity-based Pruning of Speech Representation Models
di: Dorszewski, Teresa, et al.
Pubblicazione: (2024)
di: Dorszewski, Teresa, et al.
Pubblicazione: (2024)
Dynamic Data Pruning for Automatic Speech Recognition
di: Xiao, Qiao, et al.
Pubblicazione: (2024)
di: Xiao, Qiao, et al.
Pubblicazione: (2024)
Task-Agnostic Structured Pruning of Speech Representation Models
di: Wang, Haoyu, et al.
Pubblicazione: (2023)
di: Wang, Haoyu, et al.
Pubblicazione: (2023)
Promptformer: Prompted Conformer Transducer for ASR
di: Duarte-Torres, Sergio, et al.
Pubblicazione: (2024)
di: Duarte-Torres, Sergio, et al.
Pubblicazione: (2024)
ReverbMiipher: Generative Speech Restoration meets Reverberation Characteristics Controllability
di: Nakata, Wataru, et al.
Pubblicazione: (2025)
di: Nakata, Wataru, et al.
Pubblicazione: (2025)
Extreme Encoder Output Frame Rate Reduction: Improving Computational Latencies of Large End-to-End Models
di: Prabhavalkar, Rohit, et al.
Pubblicazione: (2024)
di: Prabhavalkar, Rohit, et al.
Pubblicazione: (2024)
SpeechPrune: Context-aware Token Pruning for Speech Information Retrieval
di: Lin, Yueqian, et al.
Pubblicazione: (2024)
di: Lin, Yueqian, et al.
Pubblicazione: (2024)
SSCFormer: Push the Limit of Chunk-wise Conformer for Streaming ASR Using Sequentially Sampled Chunks and Chunked Causal Convolution
di: Wang, Fangyuan, et al.
Pubblicazione: (2022)
di: Wang, Fangyuan, et al.
Pubblicazione: (2022)
Dynamic Encoder Size Based on Data-Driven Layer-wise Pruning for Speech Recognition
di: Xu, Jingjing, et al.
Pubblicazione: (2024)
di: Xu, Jingjing, et al.
Pubblicazione: (2024)
AdaptVC: High Quality Voice Conversion with Adaptive Learning
di: Kim, Jaehun, et al.
Pubblicazione: (2025)
di: Kim, Jaehun, et al.
Pubblicazione: (2025)
Adaptive Inner Speech-Text Alignment for LLM-based Speech Translation
di: Liu, Henglyu, et al.
Pubblicazione: (2025)
di: Liu, Henglyu, et al.
Pubblicazione: (2025)
Conan: A Chunkwise Online Network for Zero-Shot Adaptive Voice Conversion
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
PI-Whisper: Designing an Adaptive and Incremental Automatic Speech Recognition System for Edge Devices
di: Nassereldine, Amir, et al.
Pubblicazione: (2024)
di: Nassereldine, Amir, et al.
Pubblicazione: (2024)
HarmoniFuse: A Component-Selective and Prompt-Adaptive Framework for Multi-Task Speech Language Modeling
di: Si, Yuke, et al.
Pubblicazione: (2025)
di: Si, Yuke, et al.
Pubblicazione: (2025)
SpeechColab Leaderboard: An Open-Source Platform for Automatic Speech Recognition Evaluation
di: Du, Jiayu, et al.
Pubblicazione: (2024)
di: Du, Jiayu, et al.
Pubblicazione: (2024)
Transducer Consistency Regularization for Speech to Text Applications
di: Tseng, Cindy, et al.
Pubblicazione: (2024)
di: Tseng, Cindy, et al.
Pubblicazione: (2024)
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
di: Everson, Kevin, et al.
Pubblicazione: (2024)
di: Everson, Kevin, et al.
Pubblicazione: (2024)
Revisiting Interpolation Augmentation for Speech-to-Text Generation
di: Xu, Chen, et al.
Pubblicazione: (2024)
di: Xu, Chen, et al.
Pubblicazione: (2024)
DeSTA: Enhancing Speech Language Models through Descriptive Speech-Text Alignment
di: Lu, Ke-Han, et al.
Pubblicazione: (2024)
di: Lu, Ke-Han, et al.
Pubblicazione: (2024)
PhoWhisper: Automatic Speech Recognition for Vietnamese
di: Le, Thanh-Thien, et al.
Pubblicazione: (2024)
di: Le, Thanh-Thien, et al.
Pubblicazione: (2024)
Optimizing Contextual Speech Recognition Using Vector Quantization for Efficient Retrieval
di: Flemotomos, Nikolaos, et al.
Pubblicazione: (2024)
di: Flemotomos, Nikolaos, et al.
Pubblicazione: (2024)
Encoding of lexical tone in self-supervised models of spoken language
di: Shen, Gaofei, et al.
Pubblicazione: (2024)
di: Shen, Gaofei, et al.
Pubblicazione: (2024)
Align-SLM: Textless Spoken Language Models with Reinforcement Learning from AI Feedback
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
Improving ASR Contextual Biasing with Guided Attention
di: Tang, Jiyang, et al.
Pubblicazione: (2024)
di: Tang, Jiyang, et al.
Pubblicazione: (2024)
Learning Fine-Grained Controllability on Speech Generation via Efficient Fine-Tuning
di: Chien, Chung-Ming, et al.
Pubblicazione: (2024)
di: Chien, Chung-Ming, et al.
Pubblicazione: (2024)
A Parameter-efficient Language Extension Framework for Multilingual ASR
di: Liu, Wei, et al.
Pubblicazione: (2024)
di: Liu, Wei, et al.
Pubblicazione: (2024)
Advancing Large Language Models to Capture Varied Speaking Styles and Respond Properly in Spoken Conversations
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
VoiceTextBlender: Augmenting Large Language Models with Speech Capabilities via Single-Stage Joint Speech-Text Supervised Fine-Tuning
di: Peng, Yifan, et al.
Pubblicazione: (2024)
di: Peng, Yifan, et al.
Pubblicazione: (2024)
Target conversation extraction: Source separation using turn-taking dynamics
di: Chen, Tuochao, et al.
Pubblicazione: (2024)
di: Chen, Tuochao, et al.
Pubblicazione: (2024)
Emilia: An Extensive, Multilingual, and Diverse Speech Dataset for Large-Scale Speech Generation
di: He, Haorui, et al.
Pubblicazione: (2024)
di: He, Haorui, et al.
Pubblicazione: (2024)
Dynamic-SUPERB Phase-2: A Collaboratively Expanding Benchmark for Measuring the Capabilities of Spoken Language Models with 180 Tasks
di: Huang, Chien-yu, et al.
Pubblicazione: (2024)
di: Huang, Chien-yu, et al.
Pubblicazione: (2024)
Fine-tuning Whisper on Low-Resource Languages for Real-World Applications
di: Timmel, Vincenzo, et al.
Pubblicazione: (2024)
di: Timmel, Vincenzo, et al.
Pubblicazione: (2024)
SpeechCaps: Advancing Instruction-Based Universal Speech Models with Multi-Talker Speaking Style Captioning
di: Huang, Chien-yu, et al.
Pubblicazione: (2024)
di: Huang, Chien-yu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Building Tailored Speech Recognizers for Japanese Speaking Assessment
di: Kubo, Yotaro, et al.
Pubblicazione: (2025) -
Miipher-2: A Universal Speech Restoration Model for Million-Hour Scale Data Restoration
di: Karita, Shigeki, et al.
Pubblicazione: (2025) -
KAME: Tandem Architecture for Enhancing Knowledge in Real-Time Speech-to-Speech Conversational AI
di: Kuroki, So, et al.
Pubblicazione: (2025) -
FLEURS-R: A Restored Multilingual Speech Corpus for Generation Tasks
di: Ma, Min, et al.
Pubblicazione: (2024) -
Pruning as Regularization: Sensitivity-Aware One-Shot Pruning in ASR
di: Irigoyen, Julian, et al.
Pubblicazione: (2025)