Unpacking Musical Symbolism in Online Communities: Content-Based and Network-Centric Approaches
Fuente:
arXiv
Guardado en:
| Autor principal: | Ziaoddini, Kajwan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Who Gets Heard? Rethinking Fairness in AI for Music Systems
por: Mehta, Atharva, et al.
Publicado: (2025)
por: Mehta, Atharva, et al.
Publicado: (2025)
Can LLMs "Reason" in Music? An Evaluation of LLMs' Capability of Music Understanding and Generation
por: Zhou, Ziya, et al.
Publicado: (2024)
por: Zhou, Ziya, et al.
Publicado: (2024)
LaunchpadGPT: Language Model as Music Visualization Designer on Launchpad
por: Xu, Siting, et al.
Publicado: (2023)
por: Xu, Siting, et al.
Publicado: (2023)
MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix
por: Ma, Ziyang, et al.
Publicado: (2025)
por: Ma, Ziyang, et al.
Publicado: (2025)
Addressing Emotion Bias in Music Emotion Recognition and Generation with Frechet Audio Distance
por: Li, Yuanchao, et al.
Publicado: (2024)
por: Li, Yuanchao, et al.
Publicado: (2024)
MusicAOG: an Energy-Based Model for Learning and Sampling a Hierarchical Representation of Symbolic Music
por: Qian, Yikai, et al.
Publicado: (2024)
por: Qian, Yikai, et al.
Publicado: (2024)
Flexible Control in Symbolic Music Generation via Musical Metadata
por: Han, Sangjun, et al.
Publicado: (2024)
por: Han, Sangjun, et al.
Publicado: (2024)
Beat-Based Rhythm Quantization of MIDI Performances
por: Wachter, Maximilian, et al.
Publicado: (2025)
por: Wachter, Maximilian, et al.
Publicado: (2025)
Optimizing Feature Extraction for Symbolic Music
por: Simonetta, Federico, et al.
Publicado: (2023)
por: Simonetta, Federico, et al.
Publicado: (2023)
Fine-Tuning MIDI-to-Audio Alignment using a Neural Network on Piano Roll and CQT Representations
por: Murgul, Sebastian, et al.
Publicado: (2025)
por: Murgul, Sebastian, et al.
Publicado: (2025)
Gender Representation in TV and Radio: Automatic Information Extraction methods versus Manual Analyses
por: Doukhan, David, et al.
Publicado: (2024)
por: Doukhan, David, et al.
Publicado: (2024)
Cross-Modal Learning for Music-to-Music-Video Description Generation
por: Mao, Zhuoyuan, et al.
Publicado: (2025)
por: Mao, Zhuoyuan, et al.
Publicado: (2025)
MuChoMusic: Evaluating Music Understanding in Multimodal Audio-Language Models
por: Weck, Benno, et al.
Publicado: (2024)
por: Weck, Benno, et al.
Publicado: (2024)
DeepResonance: Enhancing Multimodal Music Understanding via Music-centric Multi-way Instruction Tuning
por: Mao, Zhuoyuan, et al.
Publicado: (2025)
por: Mao, Zhuoyuan, et al.
Publicado: (2025)
MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response
por: Deng, Zihao, et al.
Publicado: (2023)
por: Deng, Zihao, et al.
Publicado: (2023)
ComposerX: Multi-Agent Symbolic Music Composition with LLMs
por: Deng, Qixin, et al.
Publicado: (2024)
por: Deng, Qixin, et al.
Publicado: (2024)
Audio-Thinker: Guiding Audio Language Model When and How to Think via Reinforcement Learning
por: Wu, Shu, et al.
Publicado: (2025)
por: Wu, Shu, et al.
Publicado: (2025)
Pay More Attention To Audio: Mitigating Imbalance of Cross-Modal Attention in Large Audio Language Models
por: Wang, Junyu, et al.
Publicado: (2025)
por: Wang, Junyu, et al.
Publicado: (2025)
MLLM-based Speech Recognition: When and How is Multimodality Beneficial?
por: Guan, Yiwen, et al.
Publicado: (2025)
por: Guan, Yiwen, et al.
Publicado: (2025)
Reshaping Representation Space to Balance the Safety and Over-rejection in Large Audio Language Models
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
Fretting-Transformer: Encoder-Decoder Model for MIDI to Tablature Transcription
por: Hamberger, Anna, et al.
Publicado: (2025)
por: Hamberger, Anna, et al.
Publicado: (2025)
StarVC: A Unified Auto-Regressive Framework for Joint Text and Speech Generation in Voice Conversion
por: Li, Fengjin, et al.
Publicado: (2025)
por: Li, Fengjin, et al.
Publicado: (2025)
ELEGANCE: Efficient LLM Guidance for Audio-Visual Target Speech Extraction
por: Wu, Wenxuan, et al.
Publicado: (2025)
por: Wu, Wenxuan, et al.
Publicado: (2025)
CommonVoice-SpeechRE and RPG-MoGe: Advancing Speech Relation Extraction with a New Dataset and Multi-Order Generative Framework
por: Ning, Jinzhong, et al.
Publicado: (2025)
por: Ning, Jinzhong, et al.
Publicado: (2025)
Beat and Downbeat Tracking in Performance MIDI Using an End-to-End Transformer Architecture
por: Murgul, Sebastian, et al.
Publicado: (2025)
por: Murgul, Sebastian, et al.
Publicado: (2025)
Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model
por: Ma, Ziyang, et al.
Publicado: (2025)
por: Ma, Ziyang, et al.
Publicado: (2025)
SoundMind: RL-Incentivized Logic Reasoning for Audio-Language Models
por: Diao, Xingjian, et al.
Publicado: (2025)
por: Diao, Xingjian, et al.
Publicado: (2025)
Zero-Shot End-to-End Spoken Language Understanding via Cross-Modal Selective Self-Training
por: He, Jianfeng, et al.
Publicado: (2023)
por: He, Jianfeng, et al.
Publicado: (2023)
AudioSetMix: Enhancing Audio-Language Datasets with LLM-Assisted Augmentations
por: Xu, David
Publicado: (2024)
por: Xu, David
Publicado: (2024)
MMSD-Net: Towards Multi-modal Stuttering Detection
por: Nie, Liangyu, et al.
Publicado: (2024)
por: Nie, Liangyu, et al.
Publicado: (2024)
Double Mixture: Towards Continual Event Detection from Speech
por: Kang, Jingqi, et al.
Publicado: (2024)
por: Kang, Jingqi, et al.
Publicado: (2024)
MF-AED-AEC: Speech Emotion Recognition by Leveraging Multimodal Fusion, Asr Error Detection, and Asr Error Correction
por: He, Jiajun, et al.
Publicado: (2024)
por: He, Jiajun, et al.
Publicado: (2024)
Audio Is the Achilles' Heel: Red Teaming Audio Large Multimodal Models
por: Yang, Hao, et al.
Publicado: (2024)
por: Yang, Hao, et al.
Publicado: (2024)
Resurfacing Paralinguistic Awareness in Large Audio Language Models
por: Yang, Hao, et al.
Publicado: (2026)
por: Yang, Hao, et al.
Publicado: (2026)
Missingness-resilient Video-enhanced Multimodal Disfluency Detection
por: Mohapatra, Payal, et al.
Publicado: (2024)
por: Mohapatra, Payal, et al.
Publicado: (2024)
Speech Emotion Recognition with ASR Transcripts: A Comprehensive Study on Word Error Rate and Fusion Techniques
por: Li, Yuanchao, et al.
Publicado: (2024)
por: Li, Yuanchao, et al.
Publicado: (2024)
Learning Audio Concepts from Counterfactual Natural Language
por: Vosoughi, Ali, et al.
Publicado: (2024)
por: Vosoughi, Ali, et al.
Publicado: (2024)
WavCaps: A ChatGPT-Assisted Weakly-Labelled Audio Captioning Dataset for Audio-Language Multimodal Research
por: Mei, Xinhao, et al.
Publicado: (2023)
por: Mei, Xinhao, et al.
Publicado: (2023)
Quantitative Analysis of Audio-Visual Tasks: An Information-Theoretic Perspective
por: Chen, Chen, et al.
Publicado: (2024)
por: Chen, Chen, et al.
Publicado: (2024)
Towards Expressive Video Dubbing with Multiscale Multimodal Context Interaction
por: Zhao, Yuan, et al.
Publicado: (2024)
por: Zhao, Yuan, et al.
Publicado: (2024)
Ejemplares similares
-
Who Gets Heard? Rethinking Fairness in AI for Music Systems
por: Mehta, Atharva, et al.
Publicado: (2025) -
Can LLMs "Reason" in Music? An Evaluation of LLMs' Capability of Music Understanding and Generation
por: Zhou, Ziya, et al.
Publicado: (2024) -
LaunchpadGPT: Language Model as Music Visualization Designer on Launchpad
por: Xu, Siting, et al.
Publicado: (2023) -
MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix
por: Ma, Ziyang, et al.
Publicado: (2025) -
Addressing Emotion Bias in Music Emotion Recognition and Generation with Frechet Audio Distance
por: Li, Yuanchao, et al.
Publicado: (2024)