Enregistré dans:
| Auteurs principaux: | Su, Xun, Wang, Huamin, Zhang, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.08240 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Temporal Information Reconstruction and Non-Aligned Residual in Spiking Neural Networks for Speech Classification
par: Zhang, Qi, et autres
Publié: (2024)
par: Zhang, Qi, et autres
Publié: (2024)
Persian Speech Emotion Recognition by Fine-Tuning Transformers
par: Shayaninasab, Minoo, et autres
Publié: (2024)
par: Shayaninasab, Minoo, et autres
Publié: (2024)
TS-SNN: Temporal Shift Module for Spiking Neural Networks
par: Yu, Kairong, et autres
Publié: (2025)
par: Yu, Kairong, et autres
Publié: (2025)
Efficient Finetuning for Dimensional Speech Emotion Recognition in the Age of Transformers
par: Sampath, Aneesha, et autres
Publié: (2025)
par: Sampath, Aneesha, et autres
Publié: (2025)
Speech Emotion Recognition via Entropy-Aware Score Selection
par: Chua, ChenYi, et autres
Publié: (2025)
par: Chua, ChenYi, et autres
Publié: (2025)
Focal Loss based Residual Convolutional Neural Network for Speech Emotion Recognition
par: Tripathi, Suraj, et autres
Publié: (2019)
par: Tripathi, Suraj, et autres
Publié: (2019)
Color-based Emotion Representation for Speech Emotion Recognition
par: Nagase, Ryotaro, et autres
Publié: (2026)
par: Nagase, Ryotaro, et autres
Publié: (2026)
Toward Efficient Speech Emotion Recognition via Spectral Learning and Attention
par: Lee, HyeYoung, et autres
Publié: (2025)
par: Lee, HyeYoung, et autres
Publié: (2025)
MERaLiON-SER: Robust Speech Emotion Recognition Model for English and SEA Languages
par: Sailor, Hardik B., et autres
Publié: (2025)
par: Sailor, Hardik B., et autres
Publié: (2025)
Deep Learning for Speech Emotion Recognition: A CNN Approach Utilizing Mel Spectrograms
par: Penumajji, Niketa
Publié: (2025)
par: Penumajji, Niketa
Publié: (2025)
Cross-Learning Fine-Tuning Strategy for Dysarthric Speech Recognition Via CDSD database
par: Xiao, Qing, et autres
Publié: (2025)
par: Xiao, Qing, et autres
Publié: (2025)
SyncSpeech: Efficient and Low-Latency Text-to-Speech based on Temporal Masked Transformer
par: Sheng, Zhengyan, et autres
Publié: (2025)
par: Sheng, Zhengyan, et autres
Publié: (2025)
Breaking Through the Spike: Spike Window Decoding for Accelerated and Precise Automatic Speech Recognition
par: Zhang, Wei, et autres
Publié: (2025)
par: Zhang, Wei, et autres
Publié: (2025)
Prompt Tuning of Deep Neural Networks for Speaker-adaptive Visual Speech Recognition
par: Kim, Minsu, et autres
Publié: (2023)
par: Kim, Minsu, et autres
Publié: (2023)
Active Learning with Task Adaptation Pre-training for Speech Emotion Recognition
par: Li, Dongyuan, et autres
Publié: (2024)
par: Li, Dongyuan, et autres
Publié: (2024)
Leveraging Speech PTM, Text LLM, and Emotional TTS for Speech Emotion Recognition
par: Ma, Ziyang, et autres
Publié: (2023)
par: Ma, Ziyang, et autres
Publié: (2023)
Amplifying Emotional Signals: Data-Efficient Deep Learning for Robust Speech Emotion Recognition
par: Vu, Tai
Publié: (2025)
par: Vu, Tai
Publié: (2025)
Hybrid CNN-Transformer Architecture for Arabic Speech Emotion Recognition
par: Gheffari, Youcef Soufiane, et autres
Publié: (2026)
par: Gheffari, Youcef Soufiane, et autres
Publié: (2026)
EMO-TTA: Improving Test-Time Adaptation of Audio-Language Models for Speech Emotion Recognition
par: Shi, Jiacheng, et autres
Publié: (2025)
par: Shi, Jiacheng, et autres
Publié: (2025)
Learning Physiology-Informed Vocal Spectrotemporal Representations for Speech Emotion Recognition
par: Zhang, Xu, et autres
Publié: (2026)
par: Zhang, Xu, et autres
Publié: (2026)
PSCodec: A Series of High-Fidelity Low-bitrate Neural Speech Codecs Leveraging Prompt Encoders
par: Pan, Yu, et autres
Publié: (2024)
par: Pan, Yu, et autres
Publié: (2024)
Prompt-Unseen-Emotion: Zero-shot Expressive Speech Synthesis with Prompt-LLM Contextual Knowledge for Mixed Emotions
par: Gao, Xiaoxue, et autres
Publié: (2025)
par: Gao, Xiaoxue, et autres
Publié: (2025)
VoxEmo: Benchmarking Speech Emotion Recognition with Speech LLMs
par: Zhang, Hezhao, et autres
Publié: (2026)
par: Zhang, Hezhao, et autres
Publié: (2026)
ABHINAYA -- A System for Speech Emotion Recognition In Naturalistic Conditions Challenge
par: Dutta, Soumya, et autres
Publié: (2025)
par: Dutta, Soumya, et autres
Publié: (2025)
Searching for Effective Preprocessing Method and CNN-based Architecture with Efficient Channel Attention on Speech Emotion Recognition
par: Kim, Byunggun, et autres
Publié: (2024)
par: Kim, Byunggun, et autres
Publié: (2024)
Adapting Whisper for Parameter-efficient Code-Switching Speech Recognition via Soft Prompt Tuning
par: Yang, Hongli, et autres
Publié: (2025)
par: Yang, Hongli, et autres
Publié: (2025)
SpikeVox: Towards Energy-Efficient Speech Therapy Framework with Spike-driven Generative Language Models
par: Putra, Rachmad Vidya Wicaksana, et autres
Publié: (2025)
par: Putra, Rachmad Vidya Wicaksana, et autres
Publié: (2025)
Jointly Fine-Tuning "BERT-like" Self Supervised Models to Improve Multimodal Speech Emotion Recognition
par: Siriwardhana, Shamane, et autres
Publié: (2020)
par: Siriwardhana, Shamane, et autres
Publié: (2020)
MSAC: Multiple Speech Attribute Control Method for Reliable Speech Emotion Recognition
par: Pan, Yu, et autres
Publié: (2023)
par: Pan, Yu, et autres
Publié: (2023)
Unifying EEG and Speech for Emotion Recognition: A Two-Step Joint Learning Framework for Handling Missing EEG Data During Inference
par: Tiwari, Upasana, et autres
Publié: (2025)
par: Tiwari, Upasana, et autres
Publié: (2025)
Breaking Resource Barriers in Speech Emotion Recognition via Data Distillation
par: Chang, Yi, et autres
Publié: (2024)
par: Chang, Yi, et autres
Publié: (2024)
Perceiver-Prompt: Flexible Speaker Adaptation in Whisper for Chinese Disordered Speech Recognition
par: Jiang, Yicong, et autres
Publié: (2024)
par: Jiang, Yicong, et autres
Publié: (2024)
Bimodal Connection Attention Fusion for Speech Emotion Recognition
par: Luo, Jiachen, et autres
Publié: (2025)
par: Luo, Jiachen, et autres
Publié: (2025)
Multi-Loss Learning for Speech Emotion Recognition with Energy-Adaptive Mixup and Frame-Level Attention
par: Wang, Cong, et autres
Publié: (2025)
par: Wang, Cong, et autres
Publié: (2025)
EmoShift: Lightweight Activation Steering for Enhanced Emotion-Aware Speech Synthesis
par: Zhou, Li, et autres
Publié: (2026)
par: Zhou, Li, et autres
Publié: (2026)
MFHCA: Enhancing Speech Emotion Recognition Via Multi-Spatial Fusion and Hierarchical Cooperative Attention
par: Jiao, Xinxin, et autres
Publié: (2024)
par: Jiao, Xinxin, et autres
Publié: (2024)
MuSpike: A Benchmark and Evaluation Framework for Symbolic Music Generation with Spiking Neural Networks
par: Liang, Qian, et autres
Publié: (2025)
par: Liang, Qian, et autres
Publié: (2025)
Scaling Ambiguity: Augmenting Human Annotation in Speech Emotion Recognition with Audio-Language Models
par: Zhang, Wenda, et autres
Publié: (2026)
par: Zhang, Wenda, et autres
Publié: (2026)
MATER: Multi-level Acoustic and Textual Emotion Representation for Interpretable Speech Emotion Recognition
par: Jon, Hyo Jin, et autres
Publié: (2025)
par: Jon, Hyo Jin, et autres
Publié: (2025)
Enabling Automatic Disordered Speech Recognition: An Impaired Speech Dataset in the Akan Language
par: Wiafe, Isaac, et autres
Publié: (2026)
par: Wiafe, Isaac, et autres
Publié: (2026)
Documents similaires
-
Temporal Information Reconstruction and Non-Aligned Residual in Spiking Neural Networks for Speech Classification
par: Zhang, Qi, et autres
Publié: (2024) -
Persian Speech Emotion Recognition by Fine-Tuning Transformers
par: Shayaninasab, Minoo, et autres
Publié: (2024) -
TS-SNN: Temporal Shift Module for Spiking Neural Networks
par: Yu, Kairong, et autres
Publié: (2025) -
Efficient Finetuning for Dimensional Speech Emotion Recognition in the Age of Transformers
par: Sampath, Aneesha, et autres
Publié: (2025) -
Speech Emotion Recognition via Entropy-Aware Score Selection
par: Chua, ChenYi, et autres
Publié: (2025)