Latent Granular Resynthesis using Neural Audio Codecs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tokui, Nao, Baker, Tom |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling
par: Ji, Shengpeng, et autres
Publié: (2024)
par: Ji, Shengpeng, et autres
Publié: (2024)
Gull: A Generative Multifunctional Audio Codec
par: Luo, Yi, et autres
Publié: (2024)
par: Luo, Yi, et autres
Publié: (2024)
A Closer Look at Neural Codec Resynthesis: Bridging the Gap between Codec and Waveform Generation
par: Liu, Alexander H., et autres
Publié: (2024)
par: Liu, Alexander H., et autres
Publié: (2024)
Resampling Filter Design for Multirate Neural Audio Effect Processing
par: Carson, Alistair, et autres
Publié: (2025)
par: Carson, Alistair, et autres
Publié: (2025)
A Generalized Bandsplit Neural Network for Cinematic Audio Source Separation
par: Watcharasupat, Karn N., et autres
Publié: (2023)
par: Watcharasupat, Karn N., et autres
Publié: (2023)
LiLAC: A Lightweight Latent ControlNet for Musical Audio Generation
par: Baker, Tom, et autres
Publié: (2025)
par: Baker, Tom, et autres
Publié: (2025)
Listenable Maps for Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
SNAC: Multi-Scale Neural Audio Codec
par: Siuzdak, Hubert, et autres
Publié: (2024)
par: Siuzdak, Hubert, et autres
Publié: (2024)
Listenable Maps for Zero-Shot Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
Audio synthesizer inversion in symmetric parameter spaces with approximately equivariant flow matching
par: Hayes, Ben, et autres
Publié: (2025)
par: Hayes, Ben, et autres
Publié: (2025)
EmotionCaps: Enhancing Audio Captioning Through Emotion-Augmented Data Generation
par: Manivannan, Mithun, et autres
Publié: (2024)
par: Manivannan, Mithun, et autres
Publié: (2024)
Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs
par: Kim, Minje, et autres
Publié: (2024)
par: Kim, Minje, et autres
Publié: (2024)
RepCodec: A Speech Representation Codec for Speech Tokenization
par: Huang, Zhichao, et autres
Publié: (2023)
par: Huang, Zhichao, et autres
Publié: (2023)
Aliasing-Free Neural Audio Synthesis
par: Gu, Yicheng, et autres
Publié: (2025)
par: Gu, Yicheng, et autres
Publié: (2025)
Permutation Invariant Recurrent Neural Networks for Sound Source Tracking Applications
par: Diaz-Guerra, David, et autres
Publié: (2023)
par: Diaz-Guerra, David, et autres
Publié: (2023)
Point Neuron Learning: A New Physics-Informed Neural Network Architecture
par: Bi, Hanwen, et autres
Publié: (2024)
par: Bi, Hanwen, et autres
Publié: (2024)
ANIRA: An Architecture for Neural Network Inference in Real-Time Audio Applications
par: Ackva, Valentin, et autres
Publié: (2025)
par: Ackva, Valentin, et autres
Publié: (2025)
Towards Audio Codec-based Speech Separation
par: Yip, Jia Qi, et autres
Publié: (2024)
par: Yip, Jia Qi, et autres
Publié: (2024)
PeriodGrad: Towards Pitch-Controllable Neural Vocoder Based on a Diffusion Probabilistic Model
par: Hono, Yukiya, et autres
Publié: (2024)
par: Hono, Yukiya, et autres
Publié: (2024)
A Physics-Informed Neural Network-Based Approach for the Spatial Upsampling of Spherical Microphone Arrays
par: Miotello, Federico, et autres
Publié: (2024)
par: Miotello, Federico, et autres
Publié: (2024)
Room Transfer Function Reconstruction Using Complex-valued Neural Networks and Irregularly Distributed Microphones
par: Ronchini, Francesca, et autres
Publié: (2024)
par: Ronchini, Francesca, et autres
Publié: (2024)
Generating Sample-Based Musical Instruments Using Neural Audio Codec Language Models
par: Nercessian, Shahan, et autres
Publié: (2024)
par: Nercessian, Shahan, et autres
Publié: (2024)
FunnelNet: An End-to-End Deep Learning Framework to Monitor Digital Heart Murmur in Real-Time
par: Jobayer, Md, et autres
Publié: (2024)
par: Jobayer, Md, et autres
Publié: (2024)
SemantiCodec: An Ultra Low Bitrate Semantic Audio Codec for General Sound
par: Liu, Haohe, et autres
Publié: (2024)
par: Liu, Haohe, et autres
Publié: (2024)
Bayesian Restoration of Audio Degraded by Low-Frequency Pulses Modeled via Gaussian Process
par: de Carvalho, Hugo Tremonte, et autres
Publié: (2020)
par: de Carvalho, Hugo Tremonte, et autres
Publié: (2020)
Low-Complexity Neural Wind Noise Reduction for Audio Recordings
par: Eftekhari, Hesam, et autres
Publié: (2025)
par: Eftekhari, Hesam, et autres
Publié: (2025)
Blind Estimation of Sub-band Acoustic Parameters from Ambisonics Recordings using Spectro-Spatial Covariance Features
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
Sample Rate Independent Recurrent Neural Networks for Audio Effects Processing
par: Carson, Alistair, et autres
Publié: (2024)
par: Carson, Alistair, et autres
Publié: (2024)
Audio-JEPA: Joint-Embedding Predictive Architecture for Audio Representation Learning
par: Tuncay, Ludovic, et autres
Publié: (2025)
par: Tuncay, Ludovic, et autres
Publié: (2025)
Audio signal interpolation using optimal transportation of spectrograms
par: Valdivia, David, et autres
Publié: (2025)
par: Valdivia, David, et autres
Publié: (2025)
Learning Source Disentanglement in Neural Audio Codec
par: Bie, Xiaoyu, et autres
Publié: (2024)
par: Bie, Xiaoyu, et autres
Publié: (2024)
An Explainable Proxy Model for Multiabel Audio Segmentation
par: Mariotte, Théo, et autres
Publié: (2024)
par: Mariotte, Théo, et autres
Publié: (2024)
Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders
par: Bralios, Dimitrios, et autres
Publié: (2025)
par: Bralios, Dimitrios, et autres
Publié: (2025)
Audio Compression using Periodic Gabor with Biorthogonal Exchange: Implementation Using the Zak Transform
par: Alimi, Roger, et autres
Publié: (2025)
par: Alimi, Roger, et autres
Publié: (2025)
LMAC-TD: Producing Time Domain Explanations for Audio Classifiers
par: Mancini, Eleonora, et autres
Publié: (2024)
par: Mancini, Eleonora, et autres
Publié: (2024)
Joint Source-Environment Adaptation for Deep Learning-Based Underwater Acoustic Source Ranging
par: Kari, Dariush, et autres
Publié: (2025)
par: Kari, Dariush, et autres
Publié: (2025)
Adaptive Control Attention Network for Underwater Acoustic Localization and Domain Adaptation
par: Vo, Quoc Thinh, et autres
Publié: (2025)
par: Vo, Quoc Thinh, et autres
Publié: (2025)
FlowDec: A flow-based full-band general audio codec with high perceptual quality
par: Welker, Simon, et autres
Publié: (2025)
par: Welker, Simon, et autres
Publié: (2025)
Diff-TONE: Timestep Optimization for iNstrument Editing in Text-to-Music Diffusion Models
par: Baoueb, Teysir, et autres
Publié: (2025)
par: Baoueb, Teysir, et autres
Publié: (2025)
Mismatch-Robust Underwater Acoustic Localization Using A Differentiable Modular Forward Model
par: Kari, Dariush, et autres
Publié: (2025)
par: Kari, Dariush, et autres
Publié: (2025)
Documents similaires
-
WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling
par: Ji, Shengpeng, et autres
Publié: (2024) -
Gull: A Generative Multifunctional Audio Codec
par: Luo, Yi, et autres
Publié: (2024) -
A Closer Look at Neural Codec Resynthesis: Bridging the Gap between Codec and Waveform Generation
par: Liu, Alexander H., et autres
Publié: (2024) -
Resampling Filter Design for Multirate Neural Audio Effect Processing
par: Carson, Alistair, et autres
Publié: (2025) -
A Generalized Bandsplit Neural Network for Cinematic Audio Source Separation
par: Watcharasupat, Karn N., et autres
Publié: (2023)