Exploring How Audio Effects Alter Emotion with Foundation Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Katsis, Stelios, Lyberatos, Vassilis, Kantarelis, Spyridon, Dervakos, Edmund, Stamou, Giorgos |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Perceptual Musical Features for Interpretable Audio Tagging
von: Lyberatos, Vassilis, et al.
Veröffentlicht: (2023)
von: Lyberatos, Vassilis, et al.
Veröffentlicht: (2023)
Go witheFlow: Real-time Emotion Driven Audio Effects Modulation
von: Dervakos, Edmund, et al.
Veröffentlicht: (2025)
von: Dervakos, Edmund, et al.
Veröffentlicht: (2025)
Semantic-Aware Interpretable Multimodal Music Auto-Tagging
von: Patakis, Andreas, et al.
Veröffentlicht: (2025)
von: Patakis, Andreas, et al.
Veröffentlicht: (2025)
CHORDONOMICON: A Dataset of 666,000 Songs and their Chord Progressions
von: Kantarelis, Spyridon, et al.
Veröffentlicht: (2024)
von: Kantarelis, Spyridon, et al.
Veröffentlicht: (2024)
Exploration of Perceptual Speech Features for Clinical Decision-Support in Mental Health Care
von: Lyberatos, Vassilis, et al.
Veröffentlicht: (2026)
von: Lyberatos, Vassilis, et al.
Veröffentlicht: (2026)
Music Interpretation and Emotion Perception: A Computational and Neurophysiological Investigation
von: Lyberatos, Vassilis, et al.
Veröffentlicht: (2025)
von: Lyberatos, Vassilis, et al.
Veröffentlicht: (2025)
MusicLIME: Explainable Multimodal Music Understanding
von: Sotirou, Theodoros, et al.
Veröffentlicht: (2024)
von: Sotirou, Theodoros, et al.
Veröffentlicht: (2024)
EditGen: Harnessing Cross-Attention Control for Instruction-Based Auto-Regressive Audio Editing
von: Sioros, Vassilis, et al.
Veröffentlicht: (2025)
von: Sioros, Vassilis, et al.
Veröffentlicht: (2025)
Semantic Prototypes: Enhancing Transparency Without Black Boxes
von: Menis-Mastromichalakis, Orfeas, et al.
Veröffentlicht: (2024)
von: Menis-Mastromichalakis, Orfeas, et al.
Veröffentlicht: (2024)
Robust Neural Audio Fingerprinting using Music Foundation Models
von: Singh, Shubhr, et al.
Veröffentlicht: (2025)
von: Singh, Shubhr, et al.
Veröffentlicht: (2025)
S-SONDO: Self-Supervised Knowledge Distillation for General Audio Foundation Models
von: Adlouni, Mohammed Ali El, et al.
Veröffentlicht: (2026)
von: Adlouni, Mohammed Ali El, et al.
Veröffentlicht: (2026)
EMO-TTA: Improving Test-Time Adaptation of Audio-Language Models for Speech Emotion Recognition
von: Shi, Jiacheng, et al.
Veröffentlicht: (2025)
von: Shi, Jiacheng, et al.
Veröffentlicht: (2025)
Multimodal Emotion Regression with Multi-Objective Optimization and VAD-Aware Audio Modeling for the 10th ABAW EMI Track
von: Huang, Jiawen, et al.
Veröffentlicht: (2026)
von: Huang, Jiawen, et al.
Veröffentlicht: (2026)
Are Audio-Language Models Listening? Audio-Specialist Heads for Adaptive Audio Steering
von: Glazer, Neta, et al.
Veröffentlicht: (2026)
von: Glazer, Neta, et al.
Veröffentlicht: (2026)
Audio Explanation Synthesis with Generative Foundation Models
von: Akman, Alican, et al.
Veröffentlicht: (2024)
von: Akman, Alican, et al.
Veröffentlicht: (2024)
Eureka-Audio: Triggering Audio Intelligence in Compact Language Models
von: Zhang, Dan, et al.
Veröffentlicht: (2026)
von: Zhang, Dan, et al.
Veröffentlicht: (2026)
Comparative Study of State-based Neural Networks for Virtual Analog Audio Effects Modeling
von: Simionato, Riccardo, et al.
Veröffentlicht: (2024)
von: Simionato, Riccardo, et al.
Veröffentlicht: (2024)
UltraEval-Audio: A Unified Framework for Comprehensive Evaluation of Audio Foundation Models
von: Shi, Qundong, et al.
Veröffentlicht: (2026)
von: Shi, Qundong, et al.
Veröffentlicht: (2026)
The Sonar Moment: Benchmarking Audio-Language Models in Audio Geo-Localization
von: Zhang, Ruixing, et al.
Veröffentlicht: (2026)
von: Zhang, Ruixing, et al.
Veröffentlicht: (2026)
Audio-Maestro: Enhancing Large Audio-Language Models with Tool-Augmented Reasoning
von: Lee, Kuan-Yi, et al.
Veröffentlicht: (2025)
von: Lee, Kuan-Yi, et al.
Veröffentlicht: (2025)
AudioSAE: Towards Understanding of Audio-Processing Models with Sparse AutoEncoders
von: Aparin, Georgii, et al.
Veröffentlicht: (2026)
von: Aparin, Georgii, et al.
Veröffentlicht: (2026)
Decoding Ambiguous Emotions with Test-Time Scaling in Audio-Language Models
von: Jia, Hong, et al.
Veröffentlicht: (2026)
von: Jia, Hong, et al.
Veröffentlicht: (2026)
Disentangling Reasoning in Large Audio-Language Models for Ambiguous Emotion Prediction
von: Yu, Xiaofeng, et al.
Veröffentlicht: (2026)
von: Yu, Xiaofeng, et al.
Veröffentlicht: (2026)
Audio Atlas: Visualizing and Exploring Audio Datasets
von: Lanzendörfer, Luca A., et al.
Veröffentlicht: (2024)
von: Lanzendörfer, Luca A., et al.
Veröffentlicht: (2024)
Open-Amp: Synthetic Data Framework for Audio Effect Foundation Models
von: Wright, Alec, et al.
Veröffentlicht: (2024)
von: Wright, Alec, et al.
Veröffentlicht: (2024)
AudioGuard: Toward Comprehensive Audio Safety Protection Across Diverse Threat Models
von: Kang, Mintong, et al.
Veröffentlicht: (2026)
von: Kang, Mintong, et al.
Veröffentlicht: (2026)
HalluAudio: A Comprehensive Benchmark for Hallucination Detection in Large Audio-Language Models
von: Zhao, Feiyu, et al.
Veröffentlicht: (2026)
von: Zhao, Feiyu, et al.
Veröffentlicht: (2026)
Audio-Guided Fusion Techniques for Multimodal Emotion Analysis
von: Shi, Pujin, et al.
Veröffentlicht: (2024)
von: Shi, Pujin, et al.
Veröffentlicht: (2024)
Evaluation of Audio Language Models for Fairness, Safety, and Security
von: Aloufi, Ranya, et al.
Veröffentlicht: (2026)
von: Aloufi, Ranya, et al.
Veröffentlicht: (2026)
Towards Fine-grained Temporal Perception: Post-Training Large Audio-Language Models with Audio-Side Time Prompt
von: Shi, Yanfeng, et al.
Veröffentlicht: (2026)
von: Shi, Yanfeng, et al.
Veröffentlicht: (2026)
AudioMoG: Guiding Audio Generation with Mixture-of-Guidance
von: Wang, Junyou, et al.
Veröffentlicht: (2025)
von: Wang, Junyou, et al.
Veröffentlicht: (2025)
Exploring Token-Space Manipulation in Latent Audio Tokenizers
von: Paissan, Francesco, et al.
Veröffentlicht: (2026)
von: Paissan, Francesco, et al.
Veröffentlicht: (2026)
Woosh: A Sound Effects Foundation Model
von: Hadjeres, Gaëtan, et al.
Veröffentlicht: (2026)
von: Hadjeres, Gaëtan, et al.
Veröffentlicht: (2026)
Rebellion: Noise-Robust Reasoning Training for Audio Reasoning Models
von: Huang, Tiansheng, et al.
Veröffentlicht: (2025)
von: Huang, Tiansheng, et al.
Veröffentlicht: (2025)
PitchBench: Measuring Pitch Hearing in Audio-Language Models
von: Dujardin, Milan Liessens, et al.
Veröffentlicht: (2026)
von: Dujardin, Milan Liessens, et al.
Veröffentlicht: (2026)
MeanAudio: Fast and Faithful Text-to-Audio Generation with Mean Flows
von: Li, Xiquan, et al.
Veröffentlicht: (2025)
von: Li, Xiquan, et al.
Veröffentlicht: (2025)
AudioMotionBench: Evaluating Auditory Motion Perception in Audio LLMs
von: Sun, Zhe, et al.
Veröffentlicht: (2025)
von: Sun, Zhe, et al.
Veröffentlicht: (2025)
Stable Audio 3
von: Evans, Zach, et al.
Veröffentlicht: (2026)
von: Evans, Zach, et al.
Veröffentlicht: (2026)
OWL: Geometry-Aware Spatial Reasoning for Audio Large Language Models
von: Biswas, Subrata, et al.
Veröffentlicht: (2025)
von: Biswas, Subrata, et al.
Veröffentlicht: (2025)
The World is Not Mono: Enabling Spatial Understanding in Large Audio-Language Models
von: You, Yuhuan, et al.
Veröffentlicht: (2026)
von: You, Yuhuan, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Perceptual Musical Features for Interpretable Audio Tagging
von: Lyberatos, Vassilis, et al.
Veröffentlicht: (2023) -
Go witheFlow: Real-time Emotion Driven Audio Effects Modulation
von: Dervakos, Edmund, et al.
Veröffentlicht: (2025) -
Semantic-Aware Interpretable Multimodal Music Auto-Tagging
von: Patakis, Andreas, et al.
Veröffentlicht: (2025) -
CHORDONOMICON: A Dataset of 666,000 Songs and their Chord Progressions
von: Kantarelis, Spyridon, et al.
Veröffentlicht: (2024) -
Exploration of Perceptual Speech Features for Clinical Decision-Support in Mental Health Care
von: Lyberatos, Vassilis, et al.
Veröffentlicht: (2026)