SSVD: Structured SVD for Parameter-Efficient Fine-Tuning and Benchmarking under Domain Shift in ASR
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Pu, Watanabe, Shinji, Van hamme, Hugo |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SSVD-O: Parameter-Efficient Fine-Tuning with Structured SVD for Speech Recognition
von: Wang, Pu, et al.
Veröffentlicht: (2026)
von: Wang, Pu, et al.
Veröffentlicht: (2026)
Efficient Rehearsal for Continual Learning in ASR via Singular Value Tuning
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2026)
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2026)
Inverse-Hessian Regularization for Continual Learning in ASR
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2026)
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2026)
Disentangled-Transformer: An Explainable End-to-End Automatic Speech Recognition Model with Speech Content-Context Separation
von: Wang, Pu, et al.
Veröffentlicht: (2024)
von: Wang, Pu, et al.
Veröffentlicht: (2024)
Weight Averaging: A Simple Yet Effective Method to Overcome Catastrophic Forgetting in Automatic Speech Recognition
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2022)
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2022)
Continual Learning for Monolingual End-to-End Automatic Speech Recognition
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2021)
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2021)
Improving ASR Contextual Biasing with Guided Attention
von: Tang, Jiyang, et al.
Veröffentlicht: (2024)
von: Tang, Jiyang, et al.
Veröffentlicht: (2024)
Semi-Autoregressive Streaming ASR With Label Context
von: Arora, Siddhant, et al.
Veröffentlicht: (2023)
von: Arora, Siddhant, et al.
Veröffentlicht: (2023)
The ML-SUPERB 2.0 Challenge: Towards Inclusive ASR Benchmarking for All Language Varieties
von: Chen, William, et al.
Veröffentlicht: (2025)
von: Chen, William, et al.
Veröffentlicht: (2025)
Improving Multilingual ASR in the Wild Using Simple N-best Re-ranking
von: Yan, Brian, et al.
Veröffentlicht: (2024)
von: Yan, Brian, et al.
Veröffentlicht: (2024)
Unifying Diarization, Separation, and ASR with Multi-Speaker Encoder
von: Shakeel, Muhammad, et al.
Veröffentlicht: (2025)
von: Shakeel, Muhammad, et al.
Veröffentlicht: (2025)
Who Spoke What When? Evaluating Spoken Language Models for Conversational ASR with Semantic and Overlap-Aware Metrics
von: Tawara, Naohiro, et al.
Veröffentlicht: (2026)
von: Tawara, Naohiro, et al.
Veröffentlicht: (2026)
CALM: Joint Contextual Acoustic-Linguistic Modeling for Personalization of Multi-Speaker ASR
von: Shakeel, Muhammad, et al.
Veröffentlicht: (2026)
von: Shakeel, Muhammad, et al.
Veröffentlicht: (2026)
Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC
von: Wang, Qingzheng, et al.
Veröffentlicht: (2025)
von: Wang, Qingzheng, et al.
Veröffentlicht: (2025)
Overcoming Data Scarcity in Multi-Dialectal Arabic ASR via Whisper Fine-Tuning
von: Özyilmaz, Ömer Tarik, et al.
Veröffentlicht: (2025)
von: Özyilmaz, Ömer Tarik, et al.
Veröffentlicht: (2025)
Effective Text Adaptation for LLM-based ASR through Soft Prompt Fine-Tuning
von: Ma, Yingyi, et al.
Veröffentlicht: (2024)
von: Ma, Yingyi, et al.
Veröffentlicht: (2024)
Multitask Learning with Capsule Networks for Speech-to-Intent Applications
von: Poncelet, Jakob, et al.
Veröffentlicht: (2020)
von: Poncelet, Jakob, et al.
Veröffentlicht: (2020)
VoiceTextBlender: Augmenting Large Language Models with Speech Capabilities via Single-Stage Joint Speech-Text Supervised Fine-Tuning
von: Peng, Yifan, et al.
Veröffentlicht: (2024)
von: Peng, Yifan, et al.
Veröffentlicht: (2024)
A Parameter-efficient Language Extension Framework for Multilingual ASR
von: Liu, Wei, et al.
Veröffentlicht: (2024)
von: Liu, Wei, et al.
Veröffentlicht: (2024)
Learning Fine-Grained Controllability on Speech Generation via Efficient Fine-Tuning
von: Chien, Chung-Ming, et al.
Veröffentlicht: (2024)
von: Chien, Chung-Ming, et al.
Veröffentlicht: (2024)
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
von: Wei, Victor Junqiu, et al.
Veröffentlicht: (2024)
von: Wei, Victor Junqiu, et al.
Veröffentlicht: (2024)
Mind the Shift: Using Delta SSL Embeddings to Enhance Child ASR
von: Wang, Zilai, et al.
Veröffentlicht: (2026)
von: Wang, Zilai, et al.
Veröffentlicht: (2026)
Efficient Extraction of Noise-Robust Discrete Units from Self-Supervised Speech Models
von: Poncelet, Jakob, et al.
Veröffentlicht: (2024)
von: Poncelet, Jakob, et al.
Veröffentlicht: (2024)
Language-Aware Prompt Tuning for Parameter-Efficient Seamless Language Expansion in Multilingual ASR
von: Yang, Hongli, et al.
Veröffentlicht: (2025)
von: Yang, Hongli, et al.
Veröffentlicht: (2025)
Low-Resource Domain Adaptation for Speech LLMs via Text-Only Fine-Tuning
von: Fang, Yangui, et al.
Veröffentlicht: (2025)
von: Fang, Yangui, et al.
Veröffentlicht: (2025)
Exploring the potential and limitations of Model Merging for Multi-Domain Adaptation in ASR
von: Carvalho, Carlos, et al.
Veröffentlicht: (2026)
von: Carvalho, Carlos, et al.
Veröffentlicht: (2026)
LoRA-Whisper: Parameter-Efficient and Extensible Multilingual ASR
von: Song, Zheshu, et al.
Veröffentlicht: (2024)
von: Song, Zheshu, et al.
Veröffentlicht: (2024)
Unsupervised Online Continual Learning for Automatic Speech Recognition
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2024)
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2024)
Using Adapters to Overcome Catastrophic Forgetting in End-to-End Automatic Speech Recognition
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2022)
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2022)
Leveraging Broadcast Media Subtitle Transcripts for Automatic Speech Recognition and Subtitling
von: Poncelet, Jakob, et al.
Veröffentlicht: (2025)
von: Poncelet, Jakob, et al.
Veröffentlicht: (2025)
Unsupervised Accent Adaptation Through Masked Language Model Correction Of Discrete Self-Supervised Speech Units
von: Poncelet, Jakob, et al.
Veröffentlicht: (2023)
von: Poncelet, Jakob, et al.
Veröffentlicht: (2023)
Comparison of Self-Supervised Speech Pre-Training Methods on Flemish Dutch
von: Poncelet, Jakob, et al.
Veröffentlicht: (2021)
von: Poncelet, Jakob, et al.
Veröffentlicht: (2021)
MSA-ASR: Efficient Multilingual Speaker Attribution with frozen ASR Models
von: Nguyen, Thai-Binh, et al.
Veröffentlicht: (2024)
von: Nguyen, Thai-Binh, et al.
Veröffentlicht: (2024)
Efficient Data Selection for Domain Adaptation of ASR Using Pseudo-Labels and Multi-Stage Filtering
von: Rangappa, Pradeep, et al.
Veröffentlicht: (2025)
von: Rangappa, Pradeep, et al.
Veröffentlicht: (2025)
Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics
von: Arora, Siddhant, et al.
Veröffentlicht: (2025)
von: Arora, Siddhant, et al.
Veröffentlicht: (2025)
TagSpeech: End-to-End Multi-Speaker ASR and Diarization with Fine-Grained Temporal Grounding
von: Huo, Mingyue, et al.
Veröffentlicht: (2026)
von: Huo, Mingyue, et al.
Veröffentlicht: (2026)
ContextASR-Bench: A Massive Contextual Speech Recognition Benchmark
von: Wang, He, et al.
Veröffentlicht: (2025)
von: Wang, He, et al.
Veröffentlicht: (2025)
NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR
von: Xie, Yuan, et al.
Veröffentlicht: (2026)
von: Xie, Yuan, et al.
Veröffentlicht: (2026)
WER We Stand: Benchmarking Urdu ASR Models
von: Arif, Samee, et al.
Veröffentlicht: (2024)
von: Arif, Samee, et al.
Veröffentlicht: (2024)
Efficient ASR for Low-Resource Languages: Leveraging Cross-Lingual Unlabeled Data
von: Bandarupalli, Srihari, et al.
Veröffentlicht: (2025)
von: Bandarupalli, Srihari, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
SSVD-O: Parameter-Efficient Fine-Tuning with Structured SVD for Speech Recognition
von: Wang, Pu, et al.
Veröffentlicht: (2026) -
Efficient Rehearsal for Continual Learning in ASR via Singular Value Tuning
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2026) -
Inverse-Hessian Regularization for Continual Learning in ASR
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2026) -
Disentangled-Transformer: An Explainable End-to-End Automatic Speech Recognition Model with Speech Content-Context Separation
von: Wang, Pu, et al.
Veröffentlicht: (2024) -
Weight Averaging: A Simple Yet Effective Method to Overcome Catastrophic Forgetting in Automatic Speech Recognition
von: Eeckt, Steven Vander, et al.
Veröffentlicht: (2022)