Mix2Morph: Learning Sound Morphing from Noisy Mixes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chu, Annie, García, Hugo Flores, Nieto, Oriol, Salamon, Justin, Pardo, Bryan, Seetharaman, Prem |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Generative Audio Extension and Morphing
par: Seetharaman, Prem, et autres
Publié: (2026)
par: Seetharaman, Prem, et autres
Publié: (2026)
Sketch2Sound: Controllable Audio Generation via Time-Varying Signals and Sonic Imitations
par: García, Hugo Flores, et autres
Publié: (2024)
par: García, Hugo Flores, et autres
Publié: (2024)
Audiocards: Structured Metadata Improves Audio Language Models For Sound Design
par: Sridhar, Sripathi, et autres
Publié: (2026)
par: Sridhar, Sripathi, et autres
Publié: (2026)
SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation
par: Kumar, Sonal, et autres
Publié: (2024)
par: Kumar, Sonal, et autres
Publié: (2024)
Video-Guided Foley Sound Generation with Multimodal Controls
par: Chen, Ziyang, et autres
Publié: (2024)
par: Chen, Ziyang, et autres
Publié: (2024)
AudioChat: Unified Audio Storytelling, Editing, and Understanding with Transfusion Forcing
par: Chen, William, et autres
Publié: (2026)
par: Chen, William, et autres
Publié: (2026)
The Rhythm In Anything: Audio-Prompted Drums Generation with Masked Language Modeling
par: O'Reilly, Patrick, et autres
Publié: (2025)
par: O'Reilly, Patrick, et autres
Publié: (2025)
TAC: Timestamped Audio Captioning
par: Kumar, Sonal, et autres
Publié: (2026)
par: Kumar, Sonal, et autres
Publié: (2026)
FLAM: Frame-Wise Language-Audio Modeling
par: Wu, Yusong, et autres
Publié: (2025)
par: Wu, Yusong, et autres
Publié: (2025)
Augment, Drop & Swap: Improving Diversity in LLM Captions for Efficient Music-Text Representation Learning
par: Manco, Ilaria, et autres
Publié: (2024)
par: Manco, Ilaria, et autres
Publié: (2024)
PromptSep: Generative Audio Separation via Multimodal Prompting
par: Wen, Yutong, et autres
Publié: (2025)
par: Wen, Yutong, et autres
Publié: (2025)
Code Drift: Towards Idempotent Neural Audio Codecs
par: O'Reilly, Patrick, et autres
Publié: (2024)
par: O'Reilly, Patrick, et autres
Publié: (2024)
SoundMorpher: Perceptually-Uniform Sound Morphing with Diffusion Model
par: Niu, Xinlei, et autres
Publié: (2024)
par: Niu, Xinlei, et autres
Publié: (2024)
Sound Effects and the Morphing Façade: Emotion in Sound of Projection Mapping
par: Roger Pastó Cortina
Publié: (2019)
par: Roger Pastó Cortina
Publié: (2019)
Time-Domain Voice Identity Morphing (TD-VIM): A Signal-Level Approach to Morphing Attacks on Speaker Verification Systems
par: PN, Aravinda Reddy, et autres
Publié: (2026)
par: PN, Aravinda Reddy, et autres
Publié: (2026)
Learning Perceptually Relevant Temporal Envelope Morphing
par: Dixit, Satvik, et autres
Publié: (2025)
par: Dixit, Satvik, et autres
Publié: (2025)
Text2FX: Harnessing CLAP Embeddings for Text-Guided Audio Effects
par: Chu, Annie, et autres
Publié: (2024)
par: Chu, Annie, et autres
Publié: (2024)
VoxMorph: Scalable Zero-shot Voice Identity Morphing via Disentangled Embeddings
par: Krishnamurthy, Bharath, et autres
Publié: (2026)
par: Krishnamurthy, Bharath, et autres
Publié: (2026)
Towards Controllable Audio Texture Morphing
par: Gupta, Chitralekha, et autres
Publié: (2023)
par: Gupta, Chitralekha, et autres
Publié: (2023)
Taming Audio VAEs via Target-KL Regularization
par: Seetharaman, Prem, et autres
Publié: (2026)
par: Seetharaman, Prem, et autres
Publié: (2026)
Exploring Musical Roots: Applying Audio Embeddings to Empower Influence Attribution for a Generative Music Model
par: Barnett, Julia, et autres
Publié: (2024)
par: Barnett, Julia, et autres
Publié: (2024)
Ethics Statements in AI Music Papers: The Effective and the Ineffective
par: Barnett, Julia, et autres
Publié: (2025)
par: Barnett, Julia, et autres
Publié: (2025)
Audio Hallucination Attacks: Probing the Reliability of Large Audio Language Models
par: Seth, Ashish, et autres
Publié: (2026)
par: Seth, Ashish, et autres
Publié: (2026)
Patch-Mix Contrastive Learning with Audio Spectrogram Transformer on Respiratory Sound Classification
par: Bae, Sangmin, et autres
Publié: (2023)
par: Bae, Sangmin, et autres
Publié: (2023)
SoundShift: Exploring Sound Manipulations for Accessible Mixed-Reality Awareness
par: Chang, Ruei-Che, et autres
Publié: (2024)
par: Chang, Ruei-Che, et autres
Publié: (2024)
Sound Field Translation and Mixed Source Model for Virtual Applications with Perceptual Validation
par: Birnie, Lachlan, et autres
Publié: (2020)
par: Birnie, Lachlan, et autres
Publié: (2020)
ReCLAP: Improving Zero Shot Audio Classification by Describing Sounds
par: Ghosh, Sreyan, et autres
Publié: (2024)
par: Ghosh, Sreyan, et autres
Publié: (2024)
MT-HuBERT: Self-Supervised Mix-Training for Few-Shot Keyword Spotting in Mixed Speech
par: Yuan, Junming, et autres
Publié: (2025)
par: Yuan, Junming, et autres
Publié: (2025)
Few-Shot Keyword Spotting from Mixed Speech
par: Yuan, Junming, et autres
Publié: (2024)
par: Yuan, Junming, et autres
Publié: (2024)
MixFake: Benchmarking and Enhancing Audio Deepfake Detection in Diverse Real-world Mixed Audio
par: Li, Qingcao, et autres
Publié: (2026)
par: Li, Qingcao, et autres
Publié: (2026)
WhAM: Towards A Translative Model of Sperm Whale Vocalization
par: Paradise, Orr, et autres
Publié: (2025)
par: Paradise, Orr, et autres
Publié: (2025)
Searching For Music Mixing Graphs: A Pruning Approach
par: Lee, Sungho, et autres
Publié: (2024)
par: Lee, Sungho, et autres
Publié: (2024)
High-Fidelity Neural Phonetic Posteriorgrams
par: Churchwell, Cameron, et autres
Publié: (2024)
par: Churchwell, Cameron, et autres
Publié: (2024)
Maximum Likelihood Estimation of the Direction of Sound In A Reverberant Noisy Environment
par: Mansour, Mohamed F.
Publié: (2024)
par: Mansour, Mohamed F.
Publié: (2024)
Audio Flamingo Sound-CoT Technical Report: Improving Chain-of-Thought Reasoning in Sound Understanding
par: Kong, Zhifeng, et autres
Publié: (2025)
par: Kong, Zhifeng, et autres
Publié: (2025)
Sound Masking Strategies for Interference with Mosquito Hearing
par: Faber, Justin, et autres
Publié: (2025)
par: Faber, Justin, et autres
Publié: (2025)
Sound Check: Auditing Audio Datasets
par: Agnew, William, et autres
Publié: (2024)
par: Agnew, William, et autres
Publié: (2024)
Diff-MST: Differentiable Mixing Style Transfer
par: Vanka, Soumya Sai, et autres
Publié: (2024)
par: Vanka, Soumya Sai, et autres
Publié: (2024)
MixAssist: An Audio-Language Dataset for Co-Creative AI Assistance in Music Mixing
par: Clemens, Michael, et autres
Publié: (2025)
par: Clemens, Michael, et autres
Publié: (2025)
Passive Acoustic Monitoring of Noisy Coral Reefs
par: Vishnu, Hari, et autres
Publié: (2025)
par: Vishnu, Hari, et autres
Publié: (2025)
Documents similaires
-
Generative Audio Extension and Morphing
par: Seetharaman, Prem, et autres
Publié: (2026) -
Sketch2Sound: Controllable Audio Generation via Time-Varying Signals and Sonic Imitations
par: García, Hugo Flores, et autres
Publié: (2024) -
Audiocards: Structured Metadata Improves Audio Language Models For Sound Design
par: Sridhar, Sripathi, et autres
Publié: (2026) -
SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation
par: Kumar, Sonal, et autres
Publié: (2024) -
Video-Guided Foley Sound Generation with Multimodal Controls
par: Chen, Ziyang, et autres
Publié: (2024)