Janssen 2.0: Audio Inpainting in the Time-frequency Domain
Fuente:
arXiv
Salvato in:
| Autori principali: | Mokrý, Ondřej, Balušík, Peter, Rajmic, Pavel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Audio Inpainting in Time-Frequency Domain with Phase-Aware Prior
di: Balušík, Peter, et al.
Pubblicazione: (2026)
di: Balušík, Peter, et al.
Pubblicazione: (2026)
Tweaking autoregressive methods for inpainting of gaps in audio signals
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024)
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024)
Regularized autoregressive modeling and its application to audio signal reconstruction
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024)
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024)
Multiple Hankel matrix rank minimization for audio inpainting
di: Záviška, Pavel, et al.
Pubblicazione: (2023)
di: Záviška, Pavel, et al.
Pubblicazione: (2023)
A MATLAB toolbox for Computation of Speech Transmission Index (STI)
di: Rajmic, Pavel, et al.
Pubblicazione: (2025)
di: Rajmic, Pavel, et al.
Pubblicazione: (2025)
Audio dequantization using instantaneous frequency
di: Kovanda, Vojtěch, et al.
Pubblicazione: (2025)
di: Kovanda, Vojtěch, et al.
Pubblicazione: (2025)
Diffusion-Based Audio Inpainting
di: Moliner, Eloi, et al.
Pubblicazione: (2023)
di: Moliner, Eloi, et al.
Pubblicazione: (2023)
Mixture of Experts Fusion for Fake Audio Detection Using Frozen wav2vec 2.0
di: Wang, Zhiyong, et al.
Pubblicazione: (2024)
di: Wang, Zhiyong, et al.
Pubblicazione: (2024)
STFTCodec: High-Fidelity Audio Compression through Time-Frequency Domain Representation
di: Feng, Tao, et al.
Pubblicazione: (2025)
di: Feng, Tao, et al.
Pubblicazione: (2025)
Domain Adaptation for Contrastive Audio-Language Models
di: Deshmukh, Soham, et al.
Pubblicazione: (2024)
di: Deshmukh, Soham, et al.
Pubblicazione: (2024)
A Comparative Study on Positional Encoding for Time-frequency Domain Dual-path Transformer-based Source Separation Models
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook
di: Jiang, Yidi, et al.
Pubblicazione: (2025)
di: Jiang, Yidi, et al.
Pubblicazione: (2025)
Transient Noise Removal via Diffusion-based Speech Inpainting
di: Moradi, Mordehay, et al.
Pubblicazione: (2025)
di: Moradi, Mordehay, et al.
Pubblicazione: (2025)
SONAR: Self-Distilled Continual Pre-training for Domain Adaptive Audio Representation
di: Zhang, Yizhou, et al.
Pubblicazione: (2025)
di: Zhang, Yizhou, et al.
Pubblicazione: (2025)
High-Fidelity Generative Audio Compression at 0.275kbps
di: Ma, Hao, et al.
Pubblicazione: (2026)
di: Ma, Hao, et al.
Pubblicazione: (2026)
AudioGAN: A Compact and Efficient Framework for Real-Time High-Fidelity Text-to-Audio Generation
di: Chung, HaeChun
Pubblicazione: (2025)
di: Chung, HaeChun
Pubblicazione: (2025)
Benchmarking Time-localized Explanations for Audio Classification Models
di: Bolaños, Cecilia, et al.
Pubblicazione: (2025)
di: Bolaños, Cecilia, et al.
Pubblicazione: (2025)
Sketch2Sound: Controllable Audio Generation via Time-Varying Signals and Sonic Imitations
di: García, Hugo Flores, et al.
Pubblicazione: (2024)
di: García, Hugo Flores, et al.
Pubblicazione: (2024)
Pitch Contour Exploration Across Audio Domains: A Vision-Based Transfer Learning Approach
di: Abeßer, Jakob, et al.
Pubblicazione: (2025)
di: Abeßer, Jakob, et al.
Pubblicazione: (2025)
Audiosockets: A Python socket package for Real-Time Audio Processing
di: Shu, Nicolas, et al.
Pubblicazione: (2024)
di: Shu, Nicolas, et al.
Pubblicazione: (2024)
ComplexDec: A Domain-robust High-fidelity Neural Audio Codec with Complex Spectrum Modeling
di: Wu, Yi-Chiao, et al.
Pubblicazione: (2025)
di: Wu, Yi-Chiao, et al.
Pubblicazione: (2025)
UniAudio: An Audio Foundation Model Toward Universal Audio Generation
di: Yang, Dongchao, et al.
Pubblicazione: (2023)
di: Yang, Dongchao, et al.
Pubblicazione: (2023)
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
di: Gong, Yitian, et al.
Pubblicazione: (2026)
di: Gong, Yitian, et al.
Pubblicazione: (2026)
ST-ITO: Controlling Audio Effects for Style Transfer with Inference-Time Optimization
di: Steinmetz, Christian J., et al.
Pubblicazione: (2024)
di: Steinmetz, Christian J., et al.
Pubblicazione: (2024)
Event Classification by Physics-informed Inpainting for Distributed Multichannel Acoustic Sensor with Partially Degraded Channels
di: Tonami, Noriyuki, et al.
Pubblicazione: (2026)
di: Tonami, Noriyuki, et al.
Pubblicazione: (2026)
Streaming Audio Transformers for Online Audio Tagging
di: Dinkel, Heinrich, et al.
Pubblicazione: (2023)
di: Dinkel, Heinrich, et al.
Pubblicazione: (2023)
Discrete Audio Representations for Automated Audio Captioning
di: Tian, Jingguang, et al.
Pubblicazione: (2025)
di: Tian, Jingguang, et al.
Pubblicazione: (2025)
Pengi: An Audio Language Model for Audio Tasks
di: Deshmukh, Soham, et al.
Pubblicazione: (2023)
di: Deshmukh, Soham, et al.
Pubblicazione: (2023)
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
MACE: Leveraging Audio for Evaluating Audio Captioning Systems
di: Dixit, Satvik, et al.
Pubblicazione: (2024)
di: Dixit, Satvik, et al.
Pubblicazione: (2024)
Audio Entailment: Assessing Deductive Reasoning for Audio Understanding
di: Deshmukh, Soham, et al.
Pubblicazione: (2024)
di: Deshmukh, Soham, et al.
Pubblicazione: (2024)
Audio-Mind: An Auditable Agentic Framework for Audio Understanding
di: Wang, Yucheng, et al.
Pubblicazione: (2026)
di: Wang, Yucheng, et al.
Pubblicazione: (2026)
SemanticAudio: Audio Generation and Editing in Semantic Space
di: Dai, Zheqi, et al.
Pubblicazione: (2026)
di: Dai, Zheqi, et al.
Pubblicazione: (2026)
Enhancing Speaker Verification with w2v-BERT 2.0 and Knowledge Distillation guided Structured Pruning
di: Li, Ze, et al.
Pubblicazione: (2025)
di: Li, Ze, et al.
Pubblicazione: (2025)
Synthetic Audio Forensics Evaluation (SAFE) Challenge
di: Trapeznikov, Kirill, et al.
Pubblicazione: (2025)
di: Trapeznikov, Kirill, et al.
Pubblicazione: (2025)
DSCLAP: Domain-Specific Contrastive Language-Audio Pre-Training
di: Liu, Shengqiang, et al.
Pubblicazione: (2024)
di: Liu, Shengqiang, et al.
Pubblicazione: (2024)
SRC-gAudio: Sampling-Rate-Controlled Audio Generation
di: Li, Chenxing, et al.
Pubblicazione: (2024)
di: Li, Chenxing, et al.
Pubblicazione: (2024)
AudioLCM: Text-to-Audio Generation with Latent Consistency Models
di: Liu, Huadai, et al.
Pubblicazione: (2024)
di: Liu, Huadai, et al.
Pubblicazione: (2024)
ALDAS: Audio-Linguistic Data Augmentation for Spoofed Audio Detection
di: Khanjani, Zahra, et al.
Pubblicazione: (2024)
di: Khanjani, Zahra, et al.
Pubblicazione: (2024)
PAM: Prompting Audio-Language Models for Audio Quality Assessment
di: Deshmukh, Soham, et al.
Pubblicazione: (2024)
di: Deshmukh, Soham, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Audio Inpainting in Time-Frequency Domain with Phase-Aware Prior
di: Balušík, Peter, et al.
Pubblicazione: (2026) -
Tweaking autoregressive methods for inpainting of gaps in audio signals
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024) -
Regularized autoregressive modeling and its application to audio signal reconstruction
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024) -
Multiple Hankel matrix rank minimization for audio inpainting
di: Záviška, Pavel, et al.
Pubblicazione: (2023) -
A MATLAB toolbox for Computation of Speech Transmission Index (STI)
di: Rajmic, Pavel, et al.
Pubblicazione: (2025)