Explainability Paths for Sustained Artistic Practice with AI
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tecks, Austin, Peschlow, Thomas, Vigliensoni, Gabriel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Play Me Something Icy: Practical Challenges, Explainability and the Semantic Gap in Generative AI Music
par: Allison, Jesse, et autres
Publié: (2024)
par: Allison, Jesse, et autres
Publié: (2024)
Exploring Variational Auto-Encoder Architectures, Configurations, and Datasets for Generative Music Explainable AI
par: Bryan-Kinns, Nick, et autres
Publié: (2023)
par: Bryan-Kinns, Nick, et autres
Publié: (2023)
Explainable Attribute-Based Speaker Verification
par: Wu, Xiaoliang, et autres
Publié: (2024)
par: Wu, Xiaoliang, et autres
Publié: (2024)
ExPO: Explainable Phonetic Trait-Oriented Network for Speaker Verification
par: Ma, Yi, et autres
Publié: (2025)
par: Ma, Yi, et autres
Publié: (2025)
Explainable by-design Audio Segmentation through Non-Negative Matrix Factorization and Probing
par: Lebourdais, Martin, et autres
Publié: (2024)
par: Lebourdais, Martin, et autres
Publié: (2024)
Serial-Parallel Dual-Path Architecture for Speaking Style Recognition
par: Li, Guojian, et autres
Publié: (2025)
par: Li, Guojian, et autres
Publié: (2025)
The Sounds of Home: A Speech-Removed Residential Audio Dataset for Sound Event Detection
par: Bibbó, Gabriel, et autres
Publié: (2024)
par: Bibbó, Gabriel, et autres
Publié: (2024)
Magnitude-Phase Dual-Path Speech Enhancement Network based on Self-Supervised Embedding and Perceptual Contrast Stretch Boosting
par: Mattursun, Alimjan, et autres
Publié: (2025)
par: Mattursun, Alimjan, et autres
Publié: (2025)
Practical and Reproducible Symbolic Music Generation by Large Language Models with Structural Embeddings
par: Rhyu, Seungyeon, et autres
Publié: (2024)
par: Rhyu, Seungyeon, et autres
Publié: (2024)
EchoFake: A Replay-Aware Dataset for Practical Speech Deepfake Detection
par: Zhang, Tong, et autres
Publié: (2025)
par: Zhang, Tong, et autres
Publié: (2025)
LadderSym: A Multimodal Interleaved Transformer for Music Practice Error Detection
par: Chou, Benjamin Shiue-Hal, et autres
Publié: (2025)
par: Chou, Benjamin Shiue-Hal, et autres
Publié: (2025)
AI and Tempo Estimation: A Review
par: Luck, Geoff
Publié: (2023)
par: Luck, Geoff
Publié: (2023)
Unveiling the Best Practices for Applying Speech Foundation Models to Speech Intelligibility Prediction for Hearing-Impaired People
par: Zhou, Haoshuai, et autres
Publié: (2025)
par: Zhou, Haoshuai, et autres
Publié: (2025)
SUBARU: A Practical Approach to Power Saving in Hearables Using SUB-Nyquist Audio Resolution Upsampling
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
par: Tamiti, Tarikul Islam, et autres
Publié: (2025)
Reducing Barriers to the Use of Marginalised Music Genres in AI
par: Bryan-Kinns, Nick, et autres
Publié: (2024)
par: Bryan-Kinns, Nick, et autres
Publié: (2024)
Tuning Music Education: AI-Powered Personalization in Learning Music
par: Sanganeria, Mayank, et autres
Publié: (2024)
par: Sanganeria, Mayank, et autres
Publié: (2024)
Aligning Generative Music AI with Human Preferences: Methods and Challenges
par: Herremans, Dorien, et autres
Publié: (2025)
par: Herremans, Dorien, et autres
Publié: (2025)
Sustaining model performance for covid-19 detection from dynamic audio data: Development and evaluation of a comprehensive drift-adaptive framework
par: Ganitidis, Theofanis, et autres
Publié: (2024)
par: Ganitidis, Theofanis, et autres
Publié: (2024)
Segment Transformer: AI-Generated Music Detection via Music Structural Analysis
par: Kim, Yumin, et autres
Publié: (2025)
par: Kim, Yumin, et autres
Publié: (2025)
A Tutorial on Clinical Speech AI Development: From Data Collection to Model Validation
par: Ng, Si-Ioi, et autres
Publié: (2024)
par: Ng, Si-Ioi, et autres
Publié: (2024)
Developing an Effective Training Dataset to Enhance the Performance of AI-based Speaker Separation Systems
par: Melhem, Rawad, et autres
Publié: (2024)
par: Melhem, Rawad, et autres
Publié: (2024)
MixAssist: An Audio-Language Dataset for Co-Creative AI Assistance in Music Mixing
par: Clemens, Michael, et autres
Publié: (2025)
par: Clemens, Michael, et autres
Publié: (2025)
Selective Attention System (SAS): Device-Addressed Speech Detection for Real-Time On-Device Voice AI
par: Kim, David Joohun, et autres
Publié: (2026)
par: Kim, David Joohun, et autres
Publié: (2026)
DAIRHuM: A Platform for Directly Aligning AI Representations with Human Musical Judgments applied to Carnatic Music
par: Ravikumar, Prashanth Thattai
Publié: (2024)
par: Ravikumar, Prashanth Thattai
Publié: (2024)
Wearable Music2Emotion : Assessing Emotions Induced by AI-Generated Music through Portable EEG-fNIRS Fusion
par: Zhao, Sha, et autres
Publié: (2025)
par: Zhao, Sha, et autres
Publié: (2025)
Proceedings of The second international workshop on eXplainable AI for the Arts (XAIxArts)
par: Bryan-Kinns, Nick, et autres
Publié: (2024)
par: Bryan-Kinns, Nick, et autres
Publié: (2024)
VoiceGRPO: Modern MoE Transformers with Group Relative Policy Optimization GRPO for AI Voice Health Care Applications on Voice Pathology Detection
par: Togootogtokh, Enkhtogtokh, et autres
Publié: (2025)
par: Togootogtokh, Enkhtogtokh, et autres
Publié: (2025)
Self-Supervised Models for Phoneme Recognition: Applications in Children's Speech for Reading Learning
par: Medin, Lucas Block, et autres
Publié: (2025)
par: Medin, Lucas Block, et autres
Publié: (2025)
ASoBO: Attentive Beamformer Selection for Distant Speaker Diarization in Meetings
par: Mariotte, Theo, et autres
Publié: (2024)
par: Mariotte, Theo, et autres
Publié: (2024)
Non-Intrusive Speech Intelligibility Prediction for Hearing-Impaired Users using Intermediate ASR Features and Human Memory Models
par: Mogridge, Rhiannon, et autres
Publié: (2024)
par: Mogridge, Rhiannon, et autres
Publié: (2024)
A Non-autoregressive Model for Joint STT and TTS
par: Sunder, Vishal, et autres
Publié: (2025)
par: Sunder, Vishal, et autres
Publié: (2025)
MusicLIME: Explainable Multimodal Music Understanding
par: Sotirou, Theodoros, et autres
Publié: (2024)
par: Sotirou, Theodoros, et autres
Publié: (2024)
An Investigation Into Explainable Audio Hate Speech Detection
par: An, Jinmyeong, et autres
Publié: (2024)
par: An, Jinmyeong, et autres
Publié: (2024)
DiT-Flow: Speech Enhancement Robust to Multiple Distortions based on Flow Matching in Latent Space and Diffusion Transformers
par: Cao, Tianyu, et autres
Publié: (2026)
par: Cao, Tianyu, et autres
Publié: (2026)
SoloSpeech: Enhancing Intelligibility and Quality in Target Speech Extraction through a Cascaded Generative Pipeline
par: Wang, Helin, et autres
Publié: (2025)
par: Wang, Helin, et autres
Publié: (2025)
Explainability of CNN Based Classification Models for Acoustic Signal
par: Faruqui, Zubair, et autres
Publié: (2025)
par: Faruqui, Zubair, et autres
Publié: (2025)
CapSpeech: Enabling Downstream Applications in Style-Captioned Text-to-Speech
par: Wang, Helin, et autres
Publié: (2025)
par: Wang, Helin, et autres
Publié: (2025)
AI-Generated Music Detection in Broadcast Monitoring
par: López-Ayala, David, et autres
Publié: (2026)
par: López-Ayala, David, et autres
Publié: (2026)
Investigating the Effectiveness of Explainability Methods in Parkinson's Detection from Speech
par: Mancini, Eleonora, et autres
Publié: (2024)
par: Mancini, Eleonora, et autres
Publié: (2024)
AudioGenX: Explainability on Text-to-Audio Generative Models
par: Kang, Hyunju, et autres
Publié: (2025)
par: Kang, Hyunju, et autres
Publié: (2025)
Documents similaires
-
Play Me Something Icy: Practical Challenges, Explainability and the Semantic Gap in Generative AI Music
par: Allison, Jesse, et autres
Publié: (2024) -
Exploring Variational Auto-Encoder Architectures, Configurations, and Datasets for Generative Music Explainable AI
par: Bryan-Kinns, Nick, et autres
Publié: (2023) -
Explainable Attribute-Based Speaker Verification
par: Wu, Xiaoliang, et autres
Publié: (2024) -
ExPO: Explainable Phonetic Trait-Oriented Network for Speaker Verification
par: Ma, Yi, et autres
Publié: (2025) -
Explainable by-design Audio Segmentation through Non-Negative Matrix Factorization and Probing
par: Lebourdais, Martin, et autres
Publié: (2024)