MusicHiFi: Fast High-Fidelity Stereo Vocoding
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Ge, Caceres, Juan-Pablo, Duan, Zhiyao, Bryan, Nicholas J. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An Investigation of Time-Frequency Representation Discriminators for High-Fidelity Vocoder
di: Gu, Yicheng, et al.
Pubblicazione: (2024)
di: Gu, Yicheng, et al.
Pubblicazione: (2024)
QHARMA-GAN: Quasi-Harmonic Neural Vocoder based on Autoregressive Moving Average Model
di: Chen, Shaowen, et al.
Pubblicazione: (2025)
di: Chen, Shaowen, et al.
Pubblicazione: (2025)
HiFi-Glot: High-Fidelity Neural Formant Synthesis with Differentiable Resonant Filters
di: Gu, Yicheng, et al.
Pubblicazione: (2024)
di: Gu, Yicheng, et al.
Pubblicazione: (2024)
Analyzable Chain-of-Musical-Thought Prompting for High-Fidelity Music Generation
di: Lam, Max W. Y., et al.
Pubblicazione: (2025)
di: Lam, Max W. Y., et al.
Pubblicazione: (2025)
Real-Time Streaming Mel Vocoding with Generative Flow Matching
di: Welker, Simon, et al.
Pubblicazione: (2025)
di: Welker, Simon, et al.
Pubblicazione: (2025)
U-SAM: An audio language Model for Unified Speech, Audio, and Music Understanding
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
Comparative Analysis of Fast and High-Fidelity Neural Vocoders for Low-Latency Streaming Synthesis in Resource-Constrained Environments
di: Yoneyama, Reo, et al.
Pubblicazione: (2025)
di: Yoneyama, Reo, et al.
Pubblicazione: (2025)
HiRIS: an Airborne Sonar Sensor with a 1024 Channel Microphone Array for In-Air Acoustic Imaging
di: Laurijssen, Dennis, et al.
Pubblicazione: (2024)
di: Laurijssen, Dennis, et al.
Pubblicazione: (2024)
Musical Source Separation of Brazilian Percussion
di: Namballa, Richa, et al.
Pubblicazione: (2025)
di: Namballa, Richa, et al.
Pubblicazione: (2025)
AutoMashup: Automatic Music Mashups Creation
di: Delabaere, Marine, et al.
Pubblicazione: (2025)
di: Delabaere, Marine, et al.
Pubblicazione: (2025)
Musical Score Following using Statistical Inference
di: Cowley, Josephine
Pubblicazione: (2025)
di: Cowley, Josephine
Pubblicazione: (2025)
How Does Instrumental Music Help SingFake Detection?
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
di: Chen, Xuanjun, et al.
Pubblicazione: (2025)
PeriodGrad: Towards Pitch-Controllable Neural Vocoder Based on a Diffusion Probabilistic Model
di: Hono, Yukiya, et al.
Pubblicazione: (2024)
di: Hono, Yukiya, et al.
Pubblicazione: (2024)
UniverSR: Unified and Versatile Audio Super-Resolution via Vocoder-Free Flow Matching
di: Choi, Woongjib, et al.
Pubblicazione: (2025)
di: Choi, Woongjib, et al.
Pubblicazione: (2025)
Reverse Engineering of Music Mixing Graphs with Differentiable Processors and Iterative Pruning
di: Lee, Sungho, et al.
Pubblicazione: (2025)
di: Lee, Sungho, et al.
Pubblicazione: (2025)
Cacophony: An Improved Contrastive Audio-Text Model
di: Zhu, Ge, et al.
Pubblicazione: (2024)
di: Zhu, Ge, et al.
Pubblicazione: (2024)
A Probabilistic Fusion Framework for Spoofing Aware Speaker Verification
di: Zhang, You, et al.
Pubblicazione: (2022)
di: Zhang, You, et al.
Pubblicazione: (2022)
Audio Generation Through Score-Based Generative Modeling: Design Principles and Implementation
di: Zhu, Ge, et al.
Pubblicazione: (2025)
di: Zhu, Ge, et al.
Pubblicazione: (2025)
Note-Level Singing Melody Transcription for Time-Aligned Musical Score Generation
di: Kim, Leekyung, et al.
Pubblicazione: (2025)
di: Kim, Leekyung, et al.
Pubblicazione: (2025)
Wavelet-Based Time-Frequency Fingerprinting for Feature Extraction of Traditional Irish Music
di: Shore, Noah
Pubblicazione: (2025)
di: Shore, Noah
Pubblicazione: (2025)
Do Music Source Separation Models Preserve Spatial Information in Binaural Audio?
di: Namballa, Richa, et al.
Pubblicazione: (2025)
di: Namballa, Richa, et al.
Pubblicazione: (2025)
HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution
di: Zhao, Shengkui, et al.
Pubblicazione: (2025)
di: Zhao, Shengkui, et al.
Pubblicazione: (2025)
WaveFM: A High-Fidelity and Efficient Vocoder Based on Flow Matching
di: Luo, Tianze, et al.
Pubblicazione: (2025)
di: Luo, Tianze, et al.
Pubblicazione: (2025)
Using Ear-EEG to Decode Auditory Attention in Multiple-speaker Environment
di: Zhu, Haolin, et al.
Pubblicazione: (2024)
di: Zhu, Haolin, et al.
Pubblicazione: (2024)
Informed FastICA: Semi-Blind Minimum Variance Distortionless Beamformer
di: Koldovský, Zbyněk, et al.
Pubblicazione: (2024)
di: Koldovský, Zbyněk, et al.
Pubblicazione: (2024)
SynthTab: Leveraging Synthesized Data for Guitar Tablature Transcription
di: Zang, Yongyi, et al.
Pubblicazione: (2023)
di: Zang, Yongyi, et al.
Pubblicazione: (2023)
A Machine Hearing System for Robust Cough Detection Based on a High-Level Representation of Band-Specific Audio Features
di: Monge-Alvarez, Jesús, et al.
Pubblicazione: (2024)
di: Monge-Alvarez, Jesús, et al.
Pubblicazione: (2024)
AI-Generated Music Detection in Broadcast Monitoring
di: López-Ayala, David, et al.
Pubblicazione: (2026)
di: López-Ayala, David, et al.
Pubblicazione: (2026)
UR Channel-Robust Synthetic Speech Detection System for ASVspoof 2021
di: Chen, Xinhui, et al.
Pubblicazione: (2021)
di: Chen, Xinhui, et al.
Pubblicazione: (2021)
An Empirical Study on Channel Effects for Synthetic Voice Spoofing Countermeasure Systems
di: Zhang, You, et al.
Pubblicazione: (2021)
di: Zhang, You, et al.
Pubblicazione: (2021)
Towards Improved Objective Perceptual Audio Quality Assessment -- Part 1: A Novel Data-Driven Cognitive Model
di: Delgado, Pablo M., et al.
Pubblicazione: (2024)
di: Delgado, Pablo M., et al.
Pubblicazione: (2024)
A Domain-Knowledge-Inspired Music Embedding Space and a Novel Attention Mechanism for Symbolic Music Modeling
di: Guo, Z., et al.
Pubblicazione: (2022)
di: Guo, Z., et al.
Pubblicazione: (2022)
Joint Fullband-Subband Modeling for High-Resolution SingFake Detection
di: Chen, Xuanjun, et al.
Pubblicazione: (2026)
di: Chen, Xuanjun, et al.
Pubblicazione: (2026)
Towards High-Quality and Efficient Speech Bandwidth Extension with Parallel Amplitude and Phase Prediction
di: Lu, Ye-Xin, et al.
Pubblicazione: (2024)
di: Lu, Ye-Xin, et al.
Pubblicazione: (2024)
A Data-Driven Exploration of Elevation Cues in HRTFs: An Explainable AI Perspective Across Multiple Datasets
di: De Rus, Juan Antonio, et al.
Pubblicazione: (2025)
di: De Rus, Juan Antonio, et al.
Pubblicazione: (2025)
Ultrasensitive Textile Strain Sensors Redefine Wearable Silent Speech Interfaces with High Machine Learning Efficiency
di: Tang, Chenyu, et al.
Pubblicazione: (2023)
di: Tang, Chenyu, et al.
Pubblicazione: (2023)
AI-Assisted Music Production: A User Study on Text-to-Music Models
di: Ronchini, Francesca, et al.
Pubblicazione: (2025)
di: Ronchini, Francesca, et al.
Pubblicazione: (2025)
BR-ASR: Efficient and Scalable Bias Retrieval Framework for Contextual Biasing ASR in Speech LLM
di: Gong, Xun, et al.
Pubblicazione: (2025)
di: Gong, Xun, et al.
Pubblicazione: (2025)
Benchmarking multi-component signal processing methods in the time-frequency plane
di: Miramont, Juan M., et al.
Pubblicazione: (2024)
di: Miramont, Juan M., et al.
Pubblicazione: (2024)
BiVocoder: A Bidirectional Neural Vocoder Integrating Feature Extraction and Waveform Generation
di: Du, Hui-Peng, et al.
Pubblicazione: (2024)
di: Du, Hui-Peng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
An Investigation of Time-Frequency Representation Discriminators for High-Fidelity Vocoder
di: Gu, Yicheng, et al.
Pubblicazione: (2024) -
QHARMA-GAN: Quasi-Harmonic Neural Vocoder based on Autoregressive Moving Average Model
di: Chen, Shaowen, et al.
Pubblicazione: (2025) -
HiFi-Glot: High-Fidelity Neural Formant Synthesis with Differentiable Resonant Filters
di: Gu, Yicheng, et al.
Pubblicazione: (2024) -
Analyzable Chain-of-Musical-Thought Prompting for High-Fidelity Music Generation
di: Lam, Max W. Y., et al.
Pubblicazione: (2025) -
Real-Time Streaming Mel Vocoding with Generative Flow Matching
di: Welker, Simon, et al.
Pubblicazione: (2025)