Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Zixing, Dong, Zhongren, Xu, Weixiang, Han, Jing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
HAFFormer: A Hierarchical Attention-Free Framework for Alzheimer's Disease Detection From Spontaneous Speech
por: Dong, Zhongren, et al.
Publicado: (2024)
por: Dong, Zhongren, et al.
Publicado: (2024)
ParaLBench: A Large-Scale Benchmark for Computational Paralinguistics over Acoustic Foundation Models
por: Zhang, Zixing, et al.
Publicado: (2024)
por: Zhang, Zixing, et al.
Publicado: (2024)
Leveraging Cross-Attention Transformer and Multi-Feature Fusion for Cross-Linguistic Speech Emotion Recognition
por: Zhao, Ruoyu, et al.
Publicado: (2025)
por: Zhao, Ruoyu, et al.
Publicado: (2025)
On the Contribution of Lexical Features to Speech Emotion Recognition
por: Combei, David
Publicado: (2025)
por: Combei, David
Publicado: (2025)
Vesper: A Compact and Effective Pretrained Model for Speech Emotion Recognition
por: Chen, Weidong, et al.
Publicado: (2023)
por: Chen, Weidong, et al.
Publicado: (2023)
Improving Speech-based Emotion Recognition with Contextual Utterance Analysis and LLMs
por: Zhang, Enshi, et al.
Publicado: (2024)
por: Zhang, Enshi, et al.
Publicado: (2024)
Are Paralinguistic Representations all that is needed for Speech Emotion Recognition?
por: Phukan, Orchid Chetia, et al.
Publicado: (2024)
por: Phukan, Orchid Chetia, et al.
Publicado: (2024)
ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech Synthesis
por: He, Xiangheng, et al.
Publicado: (2024)
por: He, Xiangheng, et al.
Publicado: (2024)
ArabEmoNet: A Lightweight Hybrid 2D CNN-BiLSTM Model with Attention for Robust Arabic Speech Emotion Recognition
por: Abouzeid, Ali, et al.
Publicado: (2025)
por: Abouzeid, Ali, et al.
Publicado: (2025)
PI-Whisper: Designing an Adaptive and Incremental Automatic Speech Recognition System for Edge Devices
por: Nassereldine, Amir, et al.
Publicado: (2024)
por: Nassereldine, Amir, et al.
Publicado: (2024)
Improving Speech Emotion Recognition in Under-Resourced Languages via Speech-to-Speech Translation with Bootstrapping Data Selection
por: Lin, Hsi-Che, et al.
Publicado: (2024)
por: Lin, Hsi-Che, et al.
Publicado: (2024)
BERSting at the Screams: A Benchmark for Distanced, Emotional and Shouted Speech Recognition
por: Tuttösí, Paige, et al.
Publicado: (2025)
por: Tuttösí, Paige, et al.
Publicado: (2025)
Speech Recognition Transformers: Topological-lingualism Perspective
por: Singh, Shruti, et al.
Publicado: (2024)
por: Singh, Shruti, et al.
Publicado: (2024)
MFSN: Multi-perspective Fusion Search Network For Pre-training Knowledge in Speech Emotion Recognition
por: Sun, Haiyang, et al.
Publicado: (2023)
por: Sun, Haiyang, et al.
Publicado: (2023)
RE-LLM: Refining Empathetic Speech-LLM Responses by Integrating Emotion Nuance
por: Chen, Jing-Han, et al.
Publicado: (2026)
por: Chen, Jing-Han, et al.
Publicado: (2026)
Multi-Teacher Language-Aware Knowledge Distillation for Multilingual Speech Emotion Recognition
por: Bijoy, Mehedi Hasan, et al.
Publicado: (2025)
por: Bijoy, Mehedi Hasan, et al.
Publicado: (2025)
JELLY: Joint Emotion Recognition and Context Reasoning with LLMs for Conversational Speech Synthesis
por: Cha, Jun-Hyeok, et al.
Publicado: (2025)
por: Cha, Jun-Hyeok, et al.
Publicado: (2025)
Adaptive Speech Emotion Representation Learning Based On Dynamic Graph
por: Gao, Yingxue, et al.
Publicado: (2024)
por: Gao, Yingxue, et al.
Publicado: (2024)
A Cross-Corpus Speech Emotion Recognition Method Based on Supervised Contrastive Learning
por: minjie, Xiang
Publicado: (2024)
por: minjie, Xiang
Publicado: (2024)
A Comprehensive Study on the Effectiveness of ASR Representations for Noise-Robust Speech Emotion Recognition
por: Shi, Xiaohan, et al.
Publicado: (2023)
por: Shi, Xiaohan, et al.
Publicado: (2023)
Two-stage Framework for Robust Speech Emotion Recognition Using Target Speaker Extraction in Human Speech Noise Conditions
por: Mi, Jinyi, et al.
Publicado: (2024)
por: Mi, Jinyi, et al.
Publicado: (2024)
Transliterated Zero-Shot Domain Adaptation for Automatic Speech Recognition
por: Zhu, Han, et al.
Publicado: (2024)
por: Zhu, Han, et al.
Publicado: (2024)
Leveraging Speech PTM, Text LLM, and Emotional TTS for Speech Emotion Recognition
por: Ma, Ziyang, et al.
Publicado: (2023)
por: Ma, Ziyang, et al.
Publicado: (2023)
Steering Language Model to Stable Speech Emotion Recognition via Contextual Perception and Chain of Thought
por: Zhao, Zhixian, et al.
Publicado: (2025)
por: Zhao, Zhixian, et al.
Publicado: (2025)
Distribution-based Emotion Recognition in Conversation
por: Wu, Wen, et al.
Publicado: (2022)
por: Wu, Wen, et al.
Publicado: (2022)
Layer-Wise Analysis of Self-Supervised Acoustic Word Embeddings: A Study on Speech Emotion Recognition
por: Saliba, Alexandra, et al.
Publicado: (2024)
por: Saliba, Alexandra, et al.
Publicado: (2024)
Generative Pre-trained Speech Language Model with Efficient Hierarchical Transformer
por: Zhu, Yongxin, et al.
Publicado: (2024)
por: Zhu, Yongxin, et al.
Publicado: (2024)
Mitigating Subgroup Disparities in Multi-Label Speech Emotion Recognition: A Pseudo-Labeling and Unsupervised Learning Approach
por: Lin, Yi-Cheng, et al.
Publicado: (2025)
por: Lin, Yi-Cheng, et al.
Publicado: (2025)
Joint Automatic Speech Recognition And Structure Learning For Better Speech Understanding
por: Hu, Jiliang, et al.
Publicado: (2025)
por: Hu, Jiliang, et al.
Publicado: (2025)
Emotion-Anchored Contrastive Learning Framework for Emotion Recognition in Conversation
por: Yu, Fangxu, et al.
Publicado: (2024)
por: Yu, Fangxu, et al.
Publicado: (2024)
Lightweight Audio Segmentation for Long-form Speech Translation
por: Lee, Jaesong, et al.
Publicado: (2024)
por: Lee, Jaesong, et al.
Publicado: (2024)
Sagalee: an Open Source Automatic Speech Recognition Dataset for Oromo Language
por: Abu, Turi, et al.
Publicado: (2025)
por: Abu, Turi, et al.
Publicado: (2025)
Semi-Supervised Cognitive State Classification from Speech with Multi-View Pseudo-Labeling
por: Li, Yuanchao, et al.
Publicado: (2024)
por: Li, Yuanchao, et al.
Publicado: (2024)
DQ-Data2vec: Decoupling Quantization for Multilingual Speech Recognition
por: Shao, Qijie, et al.
Publicado: (2025)
por: Shao, Qijie, et al.
Publicado: (2025)
Automatic Speech Recognition for Hindi
por: Saha, Anish, et al.
Publicado: (2024)
por: Saha, Anish, et al.
Publicado: (2024)
Pinyin Regularization in Error Correction for Chinese Speech Recognition with Large Language Models
por: Tang, Zhiyuan, et al.
Publicado: (2024)
por: Tang, Zhiyuan, et al.
Publicado: (2024)
Exploring Effective Distillation of Self-Supervised Speech Models for Automatic Speech Recognition
por: Wang, Yujin, et al.
Publicado: (2022)
por: Wang, Yujin, et al.
Publicado: (2022)
nEMO: Dataset of Emotional Speech in Polish
por: Christop, Iwona
Publicado: (2024)
por: Christop, Iwona
Publicado: (2024)
STaR: Distilling Speech Temporal Relation for Lightweight Speech Self-Supervised Learning Models
por: Jang, Kangwook, et al.
Publicado: (2023)
por: Jang, Kangwook, et al.
Publicado: (2023)
CAMEO: Collection of Multilingual Emotional Speech Corpora
por: Christop, Iwona, et al.
Publicado: (2025)
por: Christop, Iwona, et al.
Publicado: (2025)
Ejemplares similares
-
HAFFormer: A Hierarchical Attention-Free Framework for Alzheimer's Disease Detection From Spontaneous Speech
por: Dong, Zhongren, et al.
Publicado: (2024) -
ParaLBench: A Large-Scale Benchmark for Computational Paralinguistics over Acoustic Foundation Models
por: Zhang, Zixing, et al.
Publicado: (2024) -
Leveraging Cross-Attention Transformer and Multi-Feature Fusion for Cross-Linguistic Speech Emotion Recognition
por: Zhao, Ruoyu, et al.
Publicado: (2025) -
On the Contribution of Lexical Features to Speech Emotion Recognition
por: Combei, David
Publicado: (2025) -
Vesper: A Compact and Effective Pretrained Model for Speech Emotion Recognition
por: Chen, Weidong, et al.
Publicado: (2023)