Context and System Fusion in Post-ASR Emotion Recognition with Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Stepachev, Pavel, Chen, Pinzhen, Haddow, Barry |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Crossmodal ASR Error Correction with Discrete Speech Units
di: Li, Yuanchao, et al.
Pubblicazione: (2024)
di: Li, Yuanchao, et al.
Pubblicazione: (2024)
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
di: Peng, Yizhou, et al.
Pubblicazione: (2025)
Compact Speech Translation Models via Discrete Speech Units Pretraining
di: Lam, Tsz Kin, et al.
Pubblicazione: (2024)
di: Lam, Tsz Kin, et al.
Pubblicazione: (2024)
Multilingual and Fully Non-Autoregressive ASR with Large Language Model Fusion: A Comprehensive Study
di: Huang, W. Ronny, et al.
Pubblicazione: (2024)
di: Huang, W. Ronny, et al.
Pubblicazione: (2024)
Context-Enhanced Granular Edit Representation for Efficient and Accurate ASR Post-editing
di: Vejsiu, Luan, et al.
Pubblicazione: (2025)
di: Vejsiu, Luan, et al.
Pubblicazione: (2025)
Evaluating Emotion Recognition in Spoken Language Models on Emotionally Incongruent Speech
di: Corrêa, Pedro, et al.
Pubblicazione: (2025)
di: Corrêa, Pedro, et al.
Pubblicazione: (2025)
Speech Emotion Recognition with ASR Transcripts: A Comprehensive Study on Word Error Rate and Fusion Techniques
di: Li, Yuanchao, et al.
Pubblicazione: (2024)
di: Li, Yuanchao, et al.
Pubblicazione: (2024)
Large Language Models based ASR Error Correction for Child Conversations
di: Xu, Anfeng, et al.
Pubblicazione: (2025)
di: Xu, Anfeng, et al.
Pubblicazione: (2025)
ContextASR-Bench: A Massive Contextual Speech Recognition Benchmark
di: Wang, He, et al.
Pubblicazione: (2025)
di: Wang, He, et al.
Pubblicazione: (2025)
ASR-EC Benchmark: Evaluating Large Language Models on Chinese ASR Error Correction
di: Wei, Victor Junqiu, et al.
Pubblicazione: (2024)
di: Wei, Victor Junqiu, et al.
Pubblicazione: (2024)
A Comprehensive Study on the Effectiveness of ASR Representations for Noise-Robust Speech Emotion Recognition
di: Shi, Xiaohan, et al.
Pubblicazione: (2023)
di: Shi, Xiaohan, et al.
Pubblicazione: (2023)
ASR Error Correction using Large Language Models
di: Ma, Rao, et al.
Pubblicazione: (2024)
di: Ma, Rao, et al.
Pubblicazione: (2024)
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
di: Everson, Kevin, et al.
Pubblicazione: (2024)
di: Everson, Kevin, et al.
Pubblicazione: (2024)
Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling
di: Huang, Shao-Syuan, et al.
Pubblicazione: (2024)
di: Huang, Shao-Syuan, et al.
Pubblicazione: (2024)
ASR-FAIRBENCH: Measuring and Benchmarking Equity Across Speech Recognition Systems
di: Rai, Anand, et al.
Pubblicazione: (2025)
di: Rai, Anand, et al.
Pubblicazione: (2025)
Prepending or Cross-Attention for Speech-to-Text? An Empirical Comparison
di: Lam, Tsz Kin, et al.
Pubblicazione: (2025)
di: Lam, Tsz Kin, et al.
Pubblicazione: (2025)
The Sound of Healthcare: Improving Medical Transcription ASR Accuracy with Large Language Models
di: Adedeji, Ayo, et al.
Pubblicazione: (2024)
di: Adedeji, Ayo, et al.
Pubblicazione: (2024)
Large Language Model Should Understand Pinyin for Chinese ASR Error Correction
di: Li, Yuang, et al.
Pubblicazione: (2024)
di: Li, Yuang, et al.
Pubblicazione: (2024)
Just ASR + LLM? A Study on Speech Large Language Models' Ability to Identify and Understand Speaker in Spoken Dialogue
di: Wu, Junkai, et al.
Pubblicazione: (2024)
di: Wu, Junkai, et al.
Pubblicazione: (2024)
How Much Context Does My Attention-Based ASR System Need?
di: Flynn, Robert, et al.
Pubblicazione: (2023)
di: Flynn, Robert, et al.
Pubblicazione: (2023)
Multi-stage Large Language Model Correction for Speech Recognition
di: Pu, Jie, et al.
Pubblicazione: (2023)
di: Pu, Jie, et al.
Pubblicazione: (2023)
Semi-Autoregressive Streaming ASR With Label Context
di: Arora, Siddhant, et al.
Pubblicazione: (2023)
di: Arora, Siddhant, et al.
Pubblicazione: (2023)
A Mixture-of-Experts Model for Multimodal Emotion Recognition in Conversations
di: Dutta, Soumya, et al.
Pubblicazione: (2026)
di: Dutta, Soumya, et al.
Pubblicazione: (2026)
ASR Under the Stethoscope: Evaluating Biases in Clinical Speech Recognition across Indian Languages
di: Kumar, Subham, et al.
Pubblicazione: (2025)
di: Kumar, Subham, et al.
Pubblicazione: (2025)
Neuron-Level Emotion Control in Speech-Generative Large Audio-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
Discovering and Causally Validating Emotion-Sensitive Neurons in Large Audio-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
Dual-Pipeline with Low-Rank Adaptation for New Language Integration in Multilingual ASR
di: Khassanov, Yerbolat, et al.
Pubblicazione: (2024)
di: Khassanov, Yerbolat, et al.
Pubblicazione: (2024)
Chain of Correction for Full-text Speech Recognition with Large Language Models
di: Tang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Tang, Zhiyuan, et al.
Pubblicazione: (2025)
JELLY: Joint Emotion Recognition and Context Reasoning with LLMs for Conversational Speech Synthesis
di: Cha, Jun-Hyeok, et al.
Pubblicazione: (2025)
di: Cha, Jun-Hyeok, et al.
Pubblicazione: (2025)
Towards Inclusive ASR: Investigating Voice Conversion for Dysarthric Speech Recognition in Low-Resource Languages
di: Li, Chin-Jou, et al.
Pubblicazione: (2025)
di: Li, Chin-Jou, et al.
Pubblicazione: (2025)
Vesper: A Compact and Effective Pretrained Model for Speech Emotion Recognition
di: Chen, Weidong, et al.
Pubblicazione: (2023)
di: Chen, Weidong, et al.
Pubblicazione: (2023)
A Parameter-efficient Language Extension Framework for Multilingual ASR
di: Liu, Wei, et al.
Pubblicazione: (2024)
di: Liu, Wei, et al.
Pubblicazione: (2024)
Full-text Error Correction for Chinese Speech Recognition with Large Language Model
di: Tang, Zhiyuan, et al.
Pubblicazione: (2024)
di: Tang, Zhiyuan, et al.
Pubblicazione: (2024)
Dolphin: A Large-Scale Automatic Speech Recognition Model for Eastern Languages
di: Meng, Yangyang, et al.
Pubblicazione: (2025)
di: Meng, Yangyang, et al.
Pubblicazione: (2025)
Lightweight Prompt Biasing for Contextualized End-to-End ASR Systems
di: Ren, Bo, et al.
Pubblicazione: (2025)
di: Ren, Bo, et al.
Pubblicazione: (2025)
Leveraging Cross-Attention Transformer and Multi-Feature Fusion for Cross-Linguistic Speech Emotion Recognition
di: Zhao, Ruoyu, et al.
Pubblicazione: (2025)
di: Zhao, Ruoyu, et al.
Pubblicazione: (2025)
MFSN: Multi-perspective Fusion Search Network For Pre-training Knowledge in Speech Emotion Recognition
di: Sun, Haiyang, et al.
Pubblicazione: (2023)
di: Sun, Haiyang, et al.
Pubblicazione: (2023)
Diagnostic-Driven Layer-Wise Compensation for Post-Training Quantization of Encoder-Decoder ASR Models
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
Empowering Low-Resource Language ASR via Large-Scale Pseudo Labeling
di: Bhogale, Kaushal Santosh, et al.
Pubblicazione: (2024)
di: Bhogale, Kaushal Santosh, et al.
Pubblicazione: (2024)
AutoMode-ASR: Learning to Select ASR Systems for Better Quality and Cost
di: Gündüz, Ahmet, et al.
Pubblicazione: (2024)
di: Gündüz, Ahmet, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Crossmodal ASR Error Correction with Discrete Speech Units
di: Li, Yuanchao, et al.
Pubblicazione: (2024) -
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
di: Peng, Yizhou, et al.
Pubblicazione: (2025) -
Compact Speech Translation Models via Discrete Speech Units Pretraining
di: Lam, Tsz Kin, et al.
Pubblicazione: (2024) -
Multilingual and Fully Non-Autoregressive ASR with Large Language Model Fusion: A Comprehensive Study
di: Huang, W. Ronny, et al.
Pubblicazione: (2024) -
Context-Enhanced Granular Edit Representation for Efficient and Accurate ASR Post-editing
di: Vejsiu, Luan, et al.
Pubblicazione: (2025)