Iterative Feature Boosting for Explainable Speech Emotion Recognition
Fuente:
arXiv
Salvato in:
| Autori principali: | Nfissi, Alaa, Bouachir, Wassim, Bouguila, Nizar, Mishara, Brian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Unveiling Hidden Factors: Explainable AI for Feature Boosting in Speech Emotion Recognition
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
di: Nfissi, Alaa, et al.
Pubblicazione: (2024)
SigWavNet: Learning Multiresolution Signal Wavelet Network for Speech Emotion Recognition
di: Nfissi, Alaa, et al.
Pubblicazione: (2025)
di: Nfissi, Alaa, et al.
Pubblicazione: (2025)
Beyond Deep Learning: Speech Segmentation and Phone Classification with Neural Assemblies
di: Adelson, Trevor, et al.
Pubblicazione: (2026)
di: Adelson, Trevor, et al.
Pubblicazione: (2026)
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
di: Yousaf, Iqra
Pubblicazione: (2024)
di: Yousaf, Iqra
Pubblicazione: (2024)
Open-TI: Open Traffic Intelligence with Augmented Language Model
di: Da, Longchao, et al.
Pubblicazione: (2023)
di: Da, Longchao, et al.
Pubblicazione: (2023)
GraphWalk: Enabling Reasoning in Large Language Models through Tool-Based Graph Navigation
di: Ghandi, Taraneh, et al.
Pubblicazione: (2026)
di: Ghandi, Taraneh, et al.
Pubblicazione: (2026)
Enhancing Speech Emotion Recognition Leveraging Aligning Timestamps of ASR Transcripts and Speaker Diarization
di: Wang, Hsuan-Yu, et al.
Pubblicazione: (2025)
di: Wang, Hsuan-Yu, et al.
Pubblicazione: (2025)
Gyan: An Explainable Neuro-Symbolic Language Model
di: Srinivasan, Venkat, et al.
Pubblicazione: (2026)
di: Srinivasan, Venkat, et al.
Pubblicazione: (2026)
N-Agent Ad Hoc Teamwork
di: Wang, Caroline, et al.
Pubblicazione: (2024)
di: Wang, Caroline, et al.
Pubblicazione: (2024)
M6(GPT)3: Generating Multitrack Modifiable Multi-Minute MIDI Music from Text using Genetic algorithms, Probabilistic methods and GPT Models in any Progression and Time Signature
di: Poćwiardowski, Jakub, et al.
Pubblicazione: (2024)
di: Poćwiardowski, Jakub, et al.
Pubblicazione: (2024)
Survey Transfer Learning: Recycling Data with Silicon Responses
di: Amini, Ali
Pubblicazione: (2025)
di: Amini, Ali
Pubblicazione: (2025)
SpeechAccentLLM: A Unified Framework for Foreign Accent Conversion and Text to Speech
di: Cheng, Zhuangfei, et al.
Pubblicazione: (2025)
di: Cheng, Zhuangfei, et al.
Pubblicazione: (2025)
A Baseline Multimodal Approach to Emotion Recognition in Conversations
di: Yeste, Víctor, et al.
Pubblicazione: (2026)
di: Yeste, Víctor, et al.
Pubblicazione: (2026)
FATHOMS-RAG: A Framework for the Assessment of Thinking and Observation in Multimodal Systems that use Retrieval Augmented Generation
di: Hildebrand, Samuel, et al.
Pubblicazione: (2025)
di: Hildebrand, Samuel, et al.
Pubblicazione: (2025)
Developing Acoustic Models for Automatic Speech Recognition in Swedish
di: Salvi, Giampiero
Pubblicazione: (2024)
di: Salvi, Giampiero
Pubblicazione: (2024)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
di: Fang, Qitong, et al.
Pubblicazione: (2026)
di: Fang, Qitong, et al.
Pubblicazione: (2026)
On the Limits of Learned Importance Scoring for KV Cache Compression
di: Steele, Brady
Pubblicazione: (2026)
di: Steele, Brady
Pubblicazione: (2026)
Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models
di: Steele, Brady, et al.
Pubblicazione: (2026)
di: Steele, Brady, et al.
Pubblicazione: (2026)
The Reasoning-Creativity Trade-off: Toward Creativity-Driven Problem Solving
di: Luyten, Max Ruiz, et al.
Pubblicazione: (2026)
di: Luyten, Max Ruiz, et al.
Pubblicazione: (2026)
Joint Feature and Output Distillation for Low-complexity Acoustic Scene Classification
di: Li, Haowen, et al.
Pubblicazione: (2025)
di: Li, Haowen, et al.
Pubblicazione: (2025)
SeQuiFi: Mitigating Catastrophic Forgetting in Speech Emotion Recognition with Sequential Class-Finetuning
di: Jain, Sarthak, et al.
Pubblicazione: (2024)
di: Jain, Sarthak, et al.
Pubblicazione: (2024)
Evo-DKD: Dual-Knowledge Decoding for Autonomous Ontology Evolution in Large Language Models
di: Raman, Vishal, et al.
Pubblicazione: (2025)
di: Raman, Vishal, et al.
Pubblicazione: (2025)
Learning, Fast and Slow: Towards LLMs That Adapt Continually
di: Tiwari, Rishabh, et al.
Pubblicazione: (2026)
di: Tiwari, Rishabh, et al.
Pubblicazione: (2026)
Learning Natural Language Constraints for Safe Reinforcement Learning of Language Agents
di: Chua, Jaymari, et al.
Pubblicazione: (2025)
di: Chua, Jaymari, et al.
Pubblicazione: (2025)
From Search to Reasoning: A Five-Level RAG Capability Framework for Enterprise Data
di: Gill, Gurbinder, et al.
Pubblicazione: (2025)
di: Gill, Gurbinder, et al.
Pubblicazione: (2025)
Hybrid-AIRL: Enhancing Inverse Reinforcement Learning with Supervised Expert Guidance
di: Silue, Bram, et al.
Pubblicazione: (2025)
di: Silue, Bram, et al.
Pubblicazione: (2025)
ConfProBench: A Confidence Evaluation Benchmark for MLLM-Based Process Judges
di: Zhou, Yue, et al.
Pubblicazione: (2025)
di: Zhou, Yue, et al.
Pubblicazione: (2025)
ROTATE: Regret-driven Open-ended Training for Ad Hoc Teamwork
di: Wang, Caroline, et al.
Pubblicazione: (2025)
di: Wang, Caroline, et al.
Pubblicazione: (2025)
Measuring the Accuracy of Automatic Speech Recognition Solutions
di: Kuhn, Korbinian, et al.
Pubblicazione: (2024)
di: Kuhn, Korbinian, et al.
Pubblicazione: (2024)
Deep Feed-Forward Neural Network for Bangla Isolated Speech Recognition
di: Bhadra, Dipayan, et al.
Pubblicazione: (2025)
di: Bhadra, Dipayan, et al.
Pubblicazione: (2025)
Automatic Speech Recognition (ASR) for the Diagnosis of pronunciation of Speech Sound Disorders in Korean children
di: Ahn, Taekyung, et al.
Pubblicazione: (2024)
di: Ahn, Taekyung, et al.
Pubblicazione: (2024)
Boundary Regression for Leitmotif Detection in Music Audio
di: Lee, Sihun, et al.
Pubblicazione: (2025)
di: Lee, Sihun, et al.
Pubblicazione: (2025)
Quantifying the effect of speech pathology on automatic and human speaker verification
di: Halpern, Bence Mark, et al.
Pubblicazione: (2024)
di: Halpern, Bence Mark, et al.
Pubblicazione: (2024)
An Explainable Collaborative Dialogue System using a Theory of Mind
di: Cohen, Philip R., et al.
Pubblicazione: (2023)
di: Cohen, Philip R., et al.
Pubblicazione: (2023)
Dynamics of COVID-19 Misinformation: An Analysis of Conspiracy Theories, Fake Remedies, and False Reports
di: Thakur, Nirmalya, et al.
Pubblicazione: (2025)
di: Thakur, Nirmalya, et al.
Pubblicazione: (2025)
Deployment-Time Reliability of Learned Robot Policies
di: Agia, Christopher
Pubblicazione: (2026)
di: Agia, Christopher
Pubblicazione: (2026)
MOCHA: Multi-Objective Chebyshev Annealing for Agent Skill Optimization
di: Tanjim, Md Mehrab, et al.
Pubblicazione: (2026)
di: Tanjim, Md Mehrab, et al.
Pubblicazione: (2026)
Less Stress, More Privacy: Stress Detection on Anonymized Speech of Air Traffic Controllers
di: Viswanathan, Janaki, et al.
Pubblicazione: (2025)
di: Viswanathan, Janaki, et al.
Pubblicazione: (2025)
Thaka at KSAA-2026 Task 2: Regularized Fine-Tuning for Arabic Speech Diacritization
di: Alamr, Meshal, et al.
Pubblicazione: (2026)
di: Alamr, Meshal, et al.
Pubblicazione: (2026)
SW-ASR: A Context-Aware Hybrid ASR Pipeline for Robust Single Word Speech Recognition
di: Sharma, Manali, et al.
Pubblicazione: (2026)
di: Sharma, Manali, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Unveiling Hidden Factors: Explainable AI for Feature Boosting in Speech Emotion Recognition
di: Nfissi, Alaa, et al.
Pubblicazione: (2024) -
SigWavNet: Learning Multiresolution Signal Wavelet Network for Speech Emotion Recognition
di: Nfissi, Alaa, et al.
Pubblicazione: (2025) -
Beyond Deep Learning: Speech Segmentation and Phone Classification with Neural Assemblies
di: Adelson, Trevor, et al.
Pubblicazione: (2026) -
AI and Machine Learning Approaches for Predicting Nanoparticles Toxicity The Critical Role of Physiochemical Properties
di: Yousaf, Iqra
Pubblicazione: (2024) -
Open-TI: Open Traffic Intelligence with Augmented Language Model
di: Da, Longchao, et al.
Pubblicazione: (2023)