Speech Emotion Recognition with Distilled Prosodic and Linguistic Affect Representations
Fuente:
arXiv
Salvato in:
| Autori principali: | Shome, Debaditya, Etemad, Ali |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NapTune: Efficient Model Tuning for Mood Classification using Previous Night's Sleep Measures along with Wearable Time-series
di: Shome, Debaditya, et al.
Pubblicazione: (2024)
di: Shome, Debaditya, et al.
Pubblicazione: (2024)
Speech Emotion Recognition Leveraging OpenAI's Whisper Representations and Attentive Pooling Methods
di: Shendabadi, Ali, et al.
Pubblicazione: (2026)
di: Shendabadi, Ali, et al.
Pubblicazione: (2026)
Enhancing Speech Emotion Recognition with Graph-Based Multimodal Fusion and Prosodic Features for the Speech Emotion Recognition in Naturalistic Conditions Challenge at Interspeech 2025
di: Ferreira, Alef Iury Siqueira, et al.
Pubblicazione: (2025)
di: Ferreira, Alef Iury Siqueira, et al.
Pubblicazione: (2025)
UDDETTS: Unifying Discrete and Dimensional Emotions for Controllable Emotional Text-to-Speech
di: Liu, Jiaxuan, et al.
Pubblicazione: (2025)
di: Liu, Jiaxuan, et al.
Pubblicazione: (2025)
Towards Linguistic Neural Representation Learning and Sentence Retrieval from Electroencephalogram Recordings
di: Zhou, Jinzhao, et al.
Pubblicazione: (2024)
di: Zhou, Jinzhao, et al.
Pubblicazione: (2024)
Crosscoding Through Time: Tracking Emergence & Consolidation Of Linguistic Representations Throughout LLM Pretraining
di: Bayazit, Deniz, et al.
Pubblicazione: (2025)
di: Bayazit, Deniz, et al.
Pubblicazione: (2025)
TED: Turn Emphasis with Dialogue Feature Attention for Emotion Recognition in Conversation
di: Ono, Junya, et al.
Pubblicazione: (2025)
di: Ono, Junya, et al.
Pubblicazione: (2025)
ArzEn-LLM: Code-Switched Egyptian Arabic-English Translation and Speech Recognition Using LLMs
di: Heakl, Ahmed, et al.
Pubblicazione: (2024)
di: Heakl, Ahmed, et al.
Pubblicazione: (2024)
Prosodic ABX: A Language-Agnostic Method for Measuring Prosodic Contrast in Speech Representations
di: Sun, Haitong, et al.
Pubblicazione: (2026)
di: Sun, Haitong, et al.
Pubblicazione: (2026)
Causality Guided Representation Learning for Cross-Style Hate Speech Detection
di: Zhao, Chengshuai, et al.
Pubblicazione: (2025)
di: Zhao, Chengshuai, et al.
Pubblicazione: (2025)
Long-Short Distance Graph Neural Networks and Improved Curriculum Learning for Emotion Recognition in Conversation
di: Li, Xinran, et al.
Pubblicazione: (2025)
di: Li, Xinran, et al.
Pubblicazione: (2025)
Gujarati-English Code-Switching Speech Recognition using ensemble prediction of spoken language
di: Sharma, Yash, et al.
Pubblicazione: (2024)
di: Sharma, Yash, et al.
Pubblicazione: (2024)
Diffusion Language Models for Speech Recognition
di: Naveriani, Davyd, et al.
Pubblicazione: (2026)
di: Naveriani, Davyd, et al.
Pubblicazione: (2026)
Detecting Hope, Hate, and Emotion in Arabic Textual Speech and Multi-modal Memes Using Large Language Models
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
di: AlDahoul, Nouar, et al.
Pubblicazione: (2025)
Distilling Knowledge from Large Language Models: A Concept Bottleneck Model for Hate and Counter Speech Recognition
di: Labadie-Tamayo, Roberto, et al.
Pubblicazione: (2025)
di: Labadie-Tamayo, Roberto, et al.
Pubblicazione: (2025)
Efficient Long-distance Latent Relation-aware Graph Neural Network for Multi-modal Emotion Recognition in Conversations
di: Shou, Yuntao, et al.
Pubblicazione: (2024)
di: Shou, Yuntao, et al.
Pubblicazione: (2024)
Linguistic Calibration of Long-Form Generations
di: Band, Neil, et al.
Pubblicazione: (2024)
di: Band, Neil, et al.
Pubblicazione: (2024)
Sectoral Coupling in Linguistic State Space
di: Dumbrava, Sebastian
Pubblicazione: (2025)
di: Dumbrava, Sebastian
Pubblicazione: (2025)
WavSLM: Single-Stream Speech Language Modeling via WavLM Distillation
di: Della Libera, Luca, et al.
Pubblicazione: (2026)
di: Della Libera, Luca, et al.
Pubblicazione: (2026)
Large Language Model Based Generative Error Correction: A Challenge and Baselines for Speech Recognition, Speaker Tagging, and Emotion Recognition
di: Yang, Chao-Han Huck, et al.
Pubblicazione: (2024)
di: Yang, Chao-Han Huck, et al.
Pubblicazione: (2024)
AIMA at SemEval-2024 Task 10: History-Based Emotion Recognition in Hindi-English Code-Mixed Conversations
di: Abootorabi, Mohammad Mahdi, et al.
Pubblicazione: (2025)
di: Abootorabi, Mohammad Mahdi, et al.
Pubblicazione: (2025)
Perceptions of Linguistic Uncertainty by Language Models and Humans
di: Belem, Catarina G, et al.
Pubblicazione: (2024)
di: Belem, Catarina G, et al.
Pubblicazione: (2024)
Linguistic Blind Spots of Large Language Models
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
Distil-xLSTM: Learning Attention Mechanisms through Recurrent Structures
di: Thiombiano, Abdoul Majid O., et al.
Pubblicazione: (2025)
di: Thiombiano, Abdoul Majid O., et al.
Pubblicazione: (2025)
IITK at SemEval-2024 Task 10: Who is the speaker? Improving Emotion Recognition and Flip Reasoning in Conversations via Speaker Embeddings
di: Patel, Shubham, et al.
Pubblicazione: (2024)
di: Patel, Shubham, et al.
Pubblicazione: (2024)
Lightweight Operations for Visual Speech Recognition
di: Panagos, Iason Ioannis, et al.
Pubblicazione: (2025)
di: Panagos, Iason Ioannis, et al.
Pubblicazione: (2025)
Enhancing Hyperspace Analogue to Language (HAL) Representations via Attention-Based Pooling for Text Classification
di: Sakour, Ali, et al.
Pubblicazione: (2026)
di: Sakour, Ali, et al.
Pubblicazione: (2026)
DistillSpec: Improving Speculative Decoding via Knowledge Distillation
di: Zhou, Yongchao, et al.
Pubblicazione: (2023)
di: Zhou, Yongchao, et al.
Pubblicazione: (2023)
Segment, Shuffle, and Stitch: A Simple Layer for Improving Time-Series Representations
di: Grover, Shivam, et al.
Pubblicazione: (2024)
di: Grover, Shivam, et al.
Pubblicazione: (2024)
Early Linguistic Pattern of Anxiety from Social Media Using Interpretable Linguistic Features: A Multi-Faceted Validation Study with Author-Disjoint Evaluation
di: Utsa, Arnab Das
Pubblicazione: (2026)
di: Utsa, Arnab Das
Pubblicazione: (2026)
LingVarBench: Benchmarking LLMs on Entity Recognitions and Linguistic Verbalization Patterns in Phone-Call Transcripts
di: Mohammadi, Seyedali, et al.
Pubblicazione: (2025)
di: Mohammadi, Seyedali, et al.
Pubblicazione: (2025)
Stability as a Liability:Systematic Breakdown of Linguistic Structure in LLMs
di: Meng, Xianzhe, et al.
Pubblicazione: (2026)
di: Meng, Xianzhe, et al.
Pubblicazione: (2026)
Distillation Contrastive Decoding: Improving LLMs Reasoning with Contrastive Decoding and Distillation
di: Phan, Phuc, et al.
Pubblicazione: (2024)
di: Phan, Phuc, et al.
Pubblicazione: (2024)
Emotion is Not Just a Label: Latent Emotional Factors in LLM Processing
di: Reichman, Benjamin, et al.
Pubblicazione: (2026)
di: Reichman, Benjamin, et al.
Pubblicazione: (2026)
Merge-of-Thought Distillation
di: Shen, Zhanming, et al.
Pubblicazione: (2025)
di: Shen, Zhanming, et al.
Pubblicazione: (2025)
Distillation Scaling Laws
di: Busbridge, Dan, et al.
Pubblicazione: (2025)
di: Busbridge, Dan, et al.
Pubblicazione: (2025)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
di: Zhang, Songming, et al.
Pubblicazione: (2025)
di: Zhang, Songming, et al.
Pubblicazione: (2025)
ORPO-Distill: Mixed-Policy Preference Optimization for Cross-Architecture LLM Distillation
di: Singh, Aasheesh, et al.
Pubblicazione: (2025)
di: Singh, Aasheesh, et al.
Pubblicazione: (2025)
TabDistill: Distilling Transformers into Neural Nets for Few-Shot Tabular Classification
di: Dissanayake, Pasan, et al.
Pubblicazione: (2025)
di: Dissanayake, Pasan, et al.
Pubblicazione: (2025)
Heterogeneity in Formal Linguistic Competence of Language Models: Is Data the Real Bottleneck?
di: Renduchintala, H S V N S Kowndinya, et al.
Pubblicazione: (2026)
di: Renduchintala, H S V N S Kowndinya, et al.
Pubblicazione: (2026)
Documenti analoghi
-
NapTune: Efficient Model Tuning for Mood Classification using Previous Night's Sleep Measures along with Wearable Time-series
di: Shome, Debaditya, et al.
Pubblicazione: (2024) -
Speech Emotion Recognition Leveraging OpenAI's Whisper Representations and Attentive Pooling Methods
di: Shendabadi, Ali, et al.
Pubblicazione: (2026) -
Enhancing Speech Emotion Recognition with Graph-Based Multimodal Fusion and Prosodic Features for the Speech Emotion Recognition in Naturalistic Conditions Challenge at Interspeech 2025
di: Ferreira, Alef Iury Siqueira, et al.
Pubblicazione: (2025) -
UDDETTS: Unifying Discrete and Dimensional Emotions for Controllable Emotional Text-to-Speech
di: Liu, Jiaxuan, et al.
Pubblicazione: (2025) -
Towards Linguistic Neural Representation Learning and Sentence Retrieval from Electroencephalogram Recordings
di: Zhou, Jinzhao, et al.
Pubblicazione: (2024)