SoundMorpher: Perceptually-Uniform Sound Morphing with Diffusion Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Niu, Xinlei, Zhang, Jing, Martin, Charles Patrick |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SoundLoCD: An Efficient Conditional Discrete Contrastive Latent Diffusion Model for Text-to-Sound Generation
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
Reconstruction of Sound Field through Diffusion Models
di: Miotello, Federico, et al.
Pubblicazione: (2023)
di: Miotello, Federico, et al.
Pubblicazione: (2023)
Sound event localization and classification using WASN in Outdoor Environment
di: Zhang, Dongzhe, et al.
Pubblicazione: (2024)
di: Zhang, Dongzhe, et al.
Pubblicazione: (2024)
Embedding-Space Diffusion for Zero-Shot Environmental Sound Classification
di: Sims, Ysobel, et al.
Pubblicazione: (2024)
di: Sims, Ysobel, et al.
Pubblicazione: (2024)
SoundCTM: Unifying Score-based and Consistency Models for Full-band Text-to-Sound Generation
di: Saito, Koichi, et al.
Pubblicazione: (2024)
di: Saito, Koichi, et al.
Pubblicazione: (2024)
HybridVC: Efficient Voice Style Conversion with Text and Audio Prompts
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
di: Niu, Xinlei, et al.
Pubblicazione: (2024)
Feature Aggregation in Joint Sound Classification and Localization Neural Networks
di: Healy, Brendan, et al.
Pubblicazione: (2023)
di: Healy, Brendan, et al.
Pubblicazione: (2023)
SoundSculpt: Direction and Semantics Driven Ambisonic Target Sound Extraction
di: Chen, Tuochao, et al.
Pubblicazione: (2025)
di: Chen, Tuochao, et al.
Pubblicazione: (2025)
The iNaturalist Sounds Dataset
di: Chasmai, Mustafa, et al.
Pubblicazione: (2025)
di: Chasmai, Mustafa, et al.
Pubblicazione: (2025)
Advanced Framework for Animal Sound Classification With Features Optimization
di: Yang, Qiang, et al.
Pubblicazione: (2024)
di: Yang, Qiang, et al.
Pubblicazione: (2024)
Exploring Performance-Complexity Trade-Offs in Sound Event Detection Models
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
HyperGANStrument: Instrument Sound Synthesis and Editing with Pitch-Invariant Hypernetworks
di: Zhang, Zhe, et al.
Pubblicazione: (2024)
di: Zhang, Zhe, et al.
Pubblicazione: (2024)
Sound Event Detection and Localization with Distance Estimation
di: Krause, Daniel Aleksander, et al.
Pubblicazione: (2024)
di: Krause, Daniel Aleksander, et al.
Pubblicazione: (2024)
Sound Tagging in Infant-centric Home Soundscapes
di: Khan, Mohammad Nur Hossain, et al.
Pubblicazione: (2024)
di: Khan, Mohammad Nur Hossain, et al.
Pubblicazione: (2024)
Focal Modulation Networks for Interpretable Sound Classification
di: Della Libera, Luca, et al.
Pubblicazione: (2024)
di: Della Libera, Luca, et al.
Pubblicazione: (2024)
Audio Geolocation: A Natural Sounds Benchmark
di: Chasmai, Mustafa, et al.
Pubblicazione: (2025)
di: Chasmai, Mustafa, et al.
Pubblicazione: (2025)
Perceptually Transparent Binaural Auralization of Simulated Sound Fields
di: Ahrens, Jens
Pubblicazione: (2024)
di: Ahrens, Jens
Pubblicazione: (2024)
Learning to Solve Inverse Problems for Perceptual Sound Matching
di: Han, Han, et al.
Pubblicazione: (2023)
di: Han, Han, et al.
Pubblicazione: (2023)
Lungmix: A Mixup-Based Strategy for Generalization in Respiratory Sound Classification
di: Ge, Shijia, et al.
Pubblicazione: (2024)
di: Ge, Shijia, et al.
Pubblicazione: (2024)
Audio Simulation for Sound Source Localization in Virtual Evironment
di: Di Yuan, Yi, et al.
Pubblicazione: (2024)
di: Di Yuan, Yi, et al.
Pubblicazione: (2024)
Synthesizer Sound Matching Using Audio Spectrogram Transformers
di: Bruford, Fred, et al.
Pubblicazione: (2024)
di: Bruford, Fred, et al.
Pubblicazione: (2024)
Energy Consumption Trends in Sound Event Detection Systems
di: Douwes, Constance, et al.
Pubblicazione: (2024)
di: Douwes, Constance, et al.
Pubblicazione: (2024)
An Experimental Study on Joint Modeling for Sound Event Localization and Detection with Source Distance Estimation
di: Dong, Yuxuan, et al.
Pubblicazione: (2025)
di: Dong, Yuxuan, et al.
Pubblicazione: (2025)
An Enhanced Audio Feature Tailored for Anomalous Sound Detection Based on Pre-trained Models
di: Zhong, Guirui, et al.
Pubblicazione: (2025)
di: Zhong, Guirui, et al.
Pubblicazione: (2025)
Sound Field Translation and Mixed Source Model for Virtual Applications with Perceptual Validation
di: Birnie, Lachlan, et al.
Pubblicazione: (2020)
di: Birnie, Lachlan, et al.
Pubblicazione: (2020)
Mixture of Mixups for Multi-label Classification of Rare Anuran Sounds
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
Activity-Guided Industrial Anomalous Sound Detection against Interferences
di: Lee, Yunjoo, et al.
Pubblicazione: (2024)
di: Lee, Yunjoo, et al.
Pubblicazione: (2024)
Automatic Inspection Based on Switch Sounds of Electric Point Machines
di: Shibata, Ayano, et al.
Pubblicazione: (2025)
di: Shibata, Ayano, et al.
Pubblicazione: (2025)
SoundReactor: Frame-level Online Video-to-Audio Generation
di: Saito, Koichi, et al.
Pubblicazione: (2025)
di: Saito, Koichi, et al.
Pubblicazione: (2025)
Self-Supervised Learning for Few-Shot Bird Sound Classification
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
Cross-domain Sound Recognition for Efficient Underwater Data Analysis
di: Park, Jeongsoo, et al.
Pubblicazione: (2023)
di: Park, Jeongsoo, et al.
Pubblicazione: (2023)
Maximum Likelihood Estimation of the Direction of Sound In A Reverberant Noisy Environment
di: Mansour, Mohamed F.
Pubblicazione: (2024)
di: Mansour, Mohamed F.
Pubblicazione: (2024)
Abnormal Respiratory Sound Identification Using Audio-Spectrogram Vision Transformer
di: Ariyanti, Whenty, et al.
Pubblicazione: (2024)
di: Ariyanti, Whenty, et al.
Pubblicazione: (2024)
Sound Source Separation Using Latent Variational Block-Wise Disentanglement
di: Helwani, Karim, et al.
Pubblicazione: (2024)
di: Helwani, Karim, et al.
Pubblicazione: (2024)
wav2pos: Sound Source Localization using Masked Autoencoders
di: Berg, Axel, et al.
Pubblicazione: (2024)
di: Berg, Axel, et al.
Pubblicazione: (2024)
RCT: Random Consistency Training for Semi-supervised Sound Event Detection
di: Shao, Nian, et al.
Pubblicazione: (2021)
di: Shao, Nian, et al.
Pubblicazione: (2021)
A Comprehensive Survey on Heart Sound Analysis in the Deep Learning Era
di: Ren, Zhao, et al.
Pubblicazione: (2023)
di: Ren, Zhao, et al.
Pubblicazione: (2023)
Regularized Contrastive Pre-training for Few-shot Bioacoustic Sound Detection
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
MTDA-HSED: Mutual-Assistance Tuning and Dual-Branch Aggregating for Heterogeneous Sound Event Detection
di: Wang, Zehao, et al.
Pubblicazione: (2024)
di: Wang, Zehao, et al.
Pubblicazione: (2024)
Adversarial Domain Adaptation for Metal Cutting Sound Detection: Leveraging Abundant Lab Data for Scarce Industry Data
di: Mostafiz, Mir Imtiaz, et al.
Pubblicazione: (2024)
di: Mostafiz, Mir Imtiaz, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SoundLoCD: An Efficient Conditional Discrete Contrastive Latent Diffusion Model for Text-to-Sound Generation
di: Niu, Xinlei, et al.
Pubblicazione: (2024) -
Reconstruction of Sound Field through Diffusion Models
di: Miotello, Federico, et al.
Pubblicazione: (2023) -
Sound event localization and classification using WASN in Outdoor Environment
di: Zhang, Dongzhe, et al.
Pubblicazione: (2024) -
Embedding-Space Diffusion for Zero-Shot Environmental Sound Classification
di: Sims, Ysobel, et al.
Pubblicazione: (2024) -
SoundCTM: Unifying Score-based and Consistency Models for Full-band Text-to-Sound Generation
di: Saito, Koichi, et al.
Pubblicazione: (2024)