Audio dequantization using instantaneous frequency
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kovanda, Vojtěch, Rajmic, Pavel |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Janssen 2.0: Audio Inpainting in the Time-frequency Domain
par: Mokrý, Ondřej, et autres
Publié: (2024)
par: Mokrý, Ondřej, et autres
Publié: (2024)
Audio Inpainting in Time-Frequency Domain with Phase-Aware Prior
par: Balušík, Peter, et autres
Publié: (2026)
par: Balušík, Peter, et autres
Publié: (2026)
Multiple Hankel matrix rank minimization for audio inpainting
par: Záviška, Pavel, et autres
Publié: (2023)
par: Záviška, Pavel, et autres
Publié: (2023)
Tweaking autoregressive methods for inpainting of gaps in audio signals
par: Mokrý, Ondřej, et autres
Publié: (2024)
par: Mokrý, Ondřej, et autres
Publié: (2024)
Regularized autoregressive modeling and its application to audio signal reconstruction
par: Mokrý, Ondřej, et autres
Publié: (2024)
par: Mokrý, Ondřej, et autres
Publié: (2024)
A MATLAB toolbox for Computation of Speech Transmission Index (STI)
par: Rajmic, Pavel, et autres
Publié: (2025)
par: Rajmic, Pavel, et autres
Publié: (2025)
Unsupervised Estimation of Nonlinear Audio Effects: Comparing Diffusion-Based and Adversarial approaches
par: Moliner, Eloi, et autres
Publié: (2025)
par: Moliner, Eloi, et autres
Publié: (2025)
Dequantization of a signal from two parallel quantized observations
par: Kovanda, Vojtěch, et autres
Publié: (2024)
par: Kovanda, Vojtěch, et autres
Publié: (2024)
AudioSetCaps: An Enriched Audio-Caption Dataset using Automated Generation Pipeline with Large Audio and Language Models
par: Bai, Jisheng, et autres
Publié: (2024)
par: Bai, Jisheng, et autres
Publié: (2024)
Speech Separation using Neural Audio Codecs with Embedding Loss
par: Yip, Jia Qi, et autres
Publié: (2024)
par: Yip, Jia Qi, et autres
Publié: (2024)
Audio-Cogito: Towards Deep Audio Reasoning in Large Audio Language Models
par: Li, Longhao, et autres
Publié: (2026)
par: Li, Longhao, et autres
Publié: (2026)
InfiniteAudio: Infinite-Length Audio Generation with Consistency
par: Jung, Chaeyoung, et autres
Publié: (2025)
par: Jung, Chaeyoung, et autres
Publié: (2025)
Measuring Audio's Impact on Correctness: Audio-Contribution-Aware Post-Training of Large Audio Language Models
par: He, Haolin, et autres
Publié: (2025)
par: He, Haolin, et autres
Publié: (2025)
Aud-Sur: An Audio Analyzer Assistant for Audio Surveillance Applications
par: Lam, Phat, et autres
Publié: (2025)
par: Lam, Phat, et autres
Publié: (2025)
SALAD-VAE: Semantic Audio Compression with Language-Audio Distillation
par: Braun, Sebastian, et autres
Publié: (2025)
par: Braun, Sebastian, et autres
Publié: (2025)
AudioNet: Supervised Deep Hashing for Retrieval of Similar Audio Events
par: Dutta, Sagar, et autres
Publié: (2025)
par: Dutta, Sagar, et autres
Publié: (2025)
Analyzing long-term rhythm variations in Mising and Assamese using frequency domain correlates
par: Gogoi, Parismita, et autres
Publié: (2024)
par: Gogoi, Parismita, et autres
Publié: (2024)
Audio Deepfake Verification
par: Wang, Li, et autres
Publié: (2025)
par: Wang, Li, et autres
Publié: (2025)
Text-based Audio Retrieval by Learning from Similarities between Audio Captions
par: Xie, Huang, et autres
Publié: (2024)
par: Xie, Huang, et autres
Publié: (2024)
Bridging the Gap between Audio and Text using Parallel-attention for User-defined Keyword Spotting
par: Kim, Youkyum, et autres
Publié: (2024)
par: Kim, Youkyum, et autres
Publié: (2024)
Detection of manatee vocalisations using the Audio Spectrogram Transformer
par: Schiappacasse, Stefano, et autres
Publié: (2024)
par: Schiappacasse, Stefano, et autres
Publié: (2024)
Audio-Visual Speech Enhancement for Spatial Audio - Spatial-VisualVoice and the MAVE Database
par: Yaffe, Danielle, et autres
Publié: (2025)
par: Yaffe, Danielle, et autres
Publié: (2025)
Towards Evaluating Generative Audio: Insights from Neural Audio Codec Embedding Distances
par: Biswas, Arijit, et autres
Publié: (2025)
par: Biswas, Arijit, et autres
Publié: (2025)
Task-Aware Answer Preservation under Audio Compression for Large Audio Language Models
par: Ivry, Amir
Publié: (2026)
par: Ivry, Amir
Publié: (2026)
Multiplexing Neural Audio Watermarks
par: Yuan, Zheqi, et autres
Publié: (2025)
par: Yuan, Zheqi, et autres
Publié: (2025)
AudioLog: LLMs-Powered Long Audio Logging with Hybrid Token-Semantic Contrastive Learning
par: Bai, Jisheng, et autres
Publié: (2023)
par: Bai, Jisheng, et autres
Publié: (2023)
Bringing Interpretability to Neural Audio Codecs
par: Sadok, Samir, et autres
Publié: (2025)
par: Sadok, Samir, et autres
Publié: (2025)
Domain-Incremental Learning for Audio Classification
par: Mulimani, Manjunath, et autres
Publié: (2024)
par: Mulimani, Manjunath, et autres
Publié: (2024)
ODAQ: Open Dataset of Audio Quality
par: Torcoli, Matteo, et autres
Publié: (2023)
par: Torcoli, Matteo, et autres
Publié: (2023)
A Reference-free Metric for Language-Queried Audio Source Separation using Contrastive Language-Audio Pretraining
par: Xiao, Feiyang, et autres
Publié: (2024)
par: Xiao, Feiyang, et autres
Publié: (2024)
UniAudio: An Audio Foundation Model Toward Universal Audio Generation
par: Yang, Dongchao, et autres
Publié: (2023)
par: Yang, Dongchao, et autres
Publié: (2023)
Zimtohrli: An Efficient Psychoacoustic Audio Similarity Metric
par: Alakuijala, Jyrki, et autres
Publié: (2025)
par: Alakuijala, Jyrki, et autres
Publié: (2025)
StepAudio 2.5 Technical Report
par: Lin, Bin, et autres
Publié: (2026)
par: Lin, Bin, et autres
Publié: (2026)
Audio Deepfake Detection at the First Greeting: "Hi!"
par: Shi, Haohan, et autres
Publié: (2026)
par: Shi, Haohan, et autres
Publié: (2026)
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
par: Gong, Yitian, et autres
Publié: (2026)
par: Gong, Yitian, et autres
Publié: (2026)
Discrete Audio Representations for Automated Audio Captioning
par: Tian, Jingguang, et autres
Publié: (2025)
par: Tian, Jingguang, et autres
Publié: (2025)
Streaming Audio Transformers for Online Audio Tagging
par: Dinkel, Heinrich, et autres
Publié: (2023)
par: Dinkel, Heinrich, et autres
Publié: (2023)
Pengi: An Audio Language Model for Audio Tasks
par: Deshmukh, Soham, et autres
Publié: (2023)
par: Deshmukh, Soham, et autres
Publié: (2023)
Interpreting the Role of Visemes in Audio-Visual Speech Recognition
par: Papadopoulos, Aristeidis, et autres
Publié: (2025)
par: Papadopoulos, Aristeidis, et autres
Publié: (2025)
Low-latency Assistive Audio Enhancement for Neurodivergent People
par: Popescu, Alexander, et autres
Publié: (2025)
par: Popescu, Alexander, et autres
Publié: (2025)
Documents similaires
-
Janssen 2.0: Audio Inpainting in the Time-frequency Domain
par: Mokrý, Ondřej, et autres
Publié: (2024) -
Audio Inpainting in Time-Frequency Domain with Phase-Aware Prior
par: Balušík, Peter, et autres
Publié: (2026) -
Multiple Hankel matrix rank minimization for audio inpainting
par: Záviška, Pavel, et autres
Publié: (2023) -
Tweaking autoregressive methods for inpainting of gaps in audio signals
par: Mokrý, Ondřej, et autres
Publié: (2024) -
Regularized autoregressive modeling and its application to audio signal reconstruction
par: Mokrý, Ondřej, et autres
Publié: (2024)