Investigating Training Strategies and Model Robustness of Low-Rank Adaptation for Language Modeling in Speech Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Yu, Yang, Chao-Han Huck, Dinh, Tuan, Ryu, Sungho, Kolehmainen, Jari, Ren, Roger, Filimonov, Denis, Shivakumar, Prashanth G., Gandhe, Ankur, Rastow, Ariya, Xu, Jia, Bulyko, Ivan, Stolcke, Andreas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Low-rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition
di: Yu, Yu, et al.
Pubblicazione: (2023)
di: Yu, Yu, et al.
Pubblicazione: (2023)
Speech Recognition Rescoring with Large Speech-Text Foundation Models
di: Shivakumar, Prashanth Gurunath, et al.
Pubblicazione: (2024)
di: Shivakumar, Prashanth Gurunath, et al.
Pubblicazione: (2024)
Multi-Modal Retrieval For Large Language Model Based Speech Recognition
di: Kolehmainen, Jari, et al.
Pubblicazione: (2024)
di: Kolehmainen, Jari, et al.
Pubblicazione: (2024)
Streaming Speech-to-Confusion Network Speech Recognition
di: Filimonov, Denis, et al.
Pubblicazione: (2023)
di: Filimonov, Denis, et al.
Pubblicazione: (2023)
Group Relative Policy Optimization for Speech Recognition
di: Shivakumar, Prashanth Gurunath, et al.
Pubblicazione: (2025)
di: Shivakumar, Prashanth Gurunath, et al.
Pubblicazione: (2025)
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
di: Everson, Kevin, et al.
Pubblicazione: (2024)
di: Everson, Kevin, et al.
Pubblicazione: (2024)
Paralinguistics-Enhanced Large Language Modeling of Spoken Dialogue
di: Lin, Guan-Ting, et al.
Pubblicazione: (2023)
di: Lin, Guan-Ting, et al.
Pubblicazione: (2023)
Spoken Conversational Agents with Large Language Models
di: Yang, Chao-Han Huck, et al.
Pubblicazione: (2025)
di: Yang, Chao-Han Huck, et al.
Pubblicazione: (2025)
Reproducing and Dissecting Denoising Language Models for Speech Recognition
di: Koch, Dorian, et al.
Pubblicazione: (2025)
di: Koch, Dorian, et al.
Pubblicazione: (2025)
Align-SLM: Textless Spoken Language Models with Reinforcement Learning from AI Feedback
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
How to Estimate Model Transferability of Pre-Trained Speech Models?
di: Chen, Zih-Ching, et al.
Pubblicazione: (2023)
di: Chen, Zih-Ching, et al.
Pubblicazione: (2023)
Text-Utilization for Encoder-dominated Speech Recognition Models
di: Zeyer, Albert, et al.
Pubblicazione: (2026)
di: Zeyer, Albert, et al.
Pubblicazione: (2026)
Spiking and Event-driven Neuromorphic Mamba Models for Efficient Speech Recognition
di: Ahmed, Tauseef, et al.
Pubblicazione: (2026)
di: Ahmed, Tauseef, et al.
Pubblicazione: (2026)
Diffusion Language Models for Speech Recognition
di: Naveriani, Davyd, et al.
Pubblicazione: (2026)
di: Naveriani, Davyd, et al.
Pubblicazione: (2026)
PROCTER: PROnunciation-aware ConTextual adaptER for personalized speech recognition in neural transducers
di: Pandey, Rahul, et al.
Pubblicazione: (2023)
di: Pandey, Rahul, et al.
Pubblicazione: (2023)
Generative Speech Recognition Error Correction with Large Language Models and Task-Activating Prompting
di: Yang, Chao-Han Huck, et al.
Pubblicazione: (2023)
di: Yang, Chao-Han Huck, et al.
Pubblicazione: (2023)
VELoRA: A Low-Rank Adaptation Approach for Efficient RGB-Event based Recognition
di: Chen, Lan, et al.
Pubblicazione: (2024)
di: Chen, Lan, et al.
Pubblicazione: (2024)
Connective Viewpoints of Signal-to-Noise Diffusion Models
di: Doan, Khanh, et al.
Pubblicazione: (2024)
di: Doan, Khanh, et al.
Pubblicazione: (2024)
Large Language Model Assisted Adversarial Robustness Neural Architecture Search
di: Zhong, Rui, et al.
Pubblicazione: (2024)
di: Zhong, Rui, et al.
Pubblicazione: (2024)
Stable and Robust Deep Learning By Hyperbolic Tangent Exponential Linear Unit (TeLU)
di: Fernandez, Alfredo, et al.
Pubblicazione: (2024)
di: Fernandez, Alfredo, et al.
Pubblicazione: (2024)
Large Language Model-Driven Full-Component Evolution of Adaptive Large Neighborhood Search
di: Yu, Shaohua, et al.
Pubblicazione: (2026)
di: Yu, Shaohua, et al.
Pubblicazione: (2026)
Leveraging Large Language Model to Generate a Novel Metaheuristic Algorithm with CRISPE Framework
di: Zhong, Rui, et al.
Pubblicazione: (2024)
di: Zhong, Rui, et al.
Pubblicazione: (2024)
Brain-inspired Computational Modeling of Action Recognition with Recurrent Spiking Neural Networks Equipped with Reinforcement Delay Learning
di: Nadafian, Alireza, et al.
Pubblicazione: (2024)
di: Nadafian, Alireza, et al.
Pubblicazione: (2024)
Neural Architecture Search of Time-to-First-Spike-Coded Spiking Neural Networks for Efficient Eye-based Emotion Recognition
di: Liu, Qianhui, et al.
Pubblicazione: (2025)
di: Liu, Qianhui, et al.
Pubblicazione: (2025)
A Unified Platform to Evaluate STDP Learning Rule and Synapse Model using Pattern Recognition in a Spiking Neural Network
di: Maskeen, Jaskirat Singh, et al.
Pubblicazione: (2025)
di: Maskeen, Jaskirat Singh, et al.
Pubblicazione: (2025)
Equivalence of Personalized PageRank and Successor Representations
di: Millidge, Beren
Pubblicazione: (2025)
di: Millidge, Beren
Pubblicazione: (2025)
Mem-elements based Neuromorphic Hardware for Neural Network Application
di: Singh, Ankur
Pubblicazione: (2024)
di: Singh, Ankur
Pubblicazione: (2024)
Hierarchical Recurrent Adapters for Efficient Multi-Task Adaptation of Large Speech Models
di: Munkhdalai, Tsendsuren, et al.
Pubblicazione: (2024)
di: Munkhdalai, Tsendsuren, et al.
Pubblicazione: (2024)
Adaptive Exploration in Lenia with Intrinsic Multi-Objective Ranking
di: Lorantos, Niko, et al.
Pubblicazione: (2025)
di: Lorantos, Niko, et al.
Pubblicazione: (2025)
Low Rank Factorizations are Indirect Encodings for Deep Neuroevolution
di: Garbus, Jack, et al.
Pubblicazione: (2025)
di: Garbus, Jack, et al.
Pubblicazione: (2025)
Exploring the True Potential: Evaluating the Black-box Optimization Capability of Large Language Models
di: Huang, Beichen, et al.
Pubblicazione: (2024)
di: Huang, Beichen, et al.
Pubblicazione: (2024)
Natural Gradient Interpretation of Rank-One Update in CMA-ES
di: Hamano, Ryoki, et al.
Pubblicazione: (2024)
di: Hamano, Ryoki, et al.
Pubblicazione: (2024)
Evolutionary Algorithms Are Significantly More Robust to Noise When They Ignore It
di: Antipov, Denis, et al.
Pubblicazione: (2024)
di: Antipov, Denis, et al.
Pubblicazione: (2024)
Converting High-Performance and Low-Latency SNNs through Explicit Modelling of Residual Error in ANNs
di: Huang, Zhipeng, et al.
Pubblicazione: (2024)
di: Huang, Zhipeng, et al.
Pubblicazione: (2024)
Multi-Objective Covariance Matrix Adaptation MAP-Annealing
di: Zhao, Shihan, et al.
Pubblicazione: (2025)
di: Zhao, Shihan, et al.
Pubblicazione: (2025)
LLM-Guided Evolution: An Autonomous Model Optimization for Object Detection
di: Yu, YiMing, et al.
Pubblicazione: (2025)
di: Yu, YiMing, et al.
Pubblicazione: (2025)
Deep Insights into Automated Optimization with Large Language Models and Evolutionary Algorithms
di: Yu, He, et al.
Pubblicazione: (2024)
di: Yu, He, et al.
Pubblicazione: (2024)
Covariance Matrix Adaptation Evolution Strategy for Low Effective Dimensionality
di: Uchida, Kento, et al.
Pubblicazione: (2024)
di: Uchida, Kento, et al.
Pubblicazione: (2024)
Case Study of Novelty, Complexity, and Adaptation in a Multicellular System
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
On the Interaction of Adaptive Population Control with Cumulative Step-Size Adaptation
di: Omeradzic, Amir, et al.
Pubblicazione: (2024)
di: Omeradzic, Amir, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Low-rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition
di: Yu, Yu, et al.
Pubblicazione: (2023) -
Speech Recognition Rescoring with Large Speech-Text Foundation Models
di: Shivakumar, Prashanth Gurunath, et al.
Pubblicazione: (2024) -
Multi-Modal Retrieval For Large Language Model Based Speech Recognition
di: Kolehmainen, Jari, et al.
Pubblicazione: (2024) -
Streaming Speech-to-Confusion Network Speech Recognition
di: Filimonov, Denis, et al.
Pubblicazione: (2023) -
Group Relative Policy Optimization for Speech Recognition
di: Shivakumar, Prashanth Gurunath, et al.
Pubblicazione: (2025)