Explicit Context-Driven Neural Acoustic Modeling for High-Fidelity RIR Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Si, Chen, Wu, Qianyi, Amballa, Chaitanya, Choudhury, Romit Roy |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Whisper-RIR-Mega: A Paired Clean-Reverberant Speech Benchmark for ASR Robustness to Room Acoustics
di: Goswami, Mandip
Pubblicazione: (2026)
di: Goswami, Mandip
Pubblicazione: (2026)
Learning Energy-based Variational Latent Prior for VAEs
di: Dutta, Debottam, et al.
Pubblicazione: (2025)
di: Dutta, Debottam, et al.
Pubblicazione: (2025)
Survey on the Evaluation of Generative Models in Music
di: Lerch, Alexander, et al.
Pubblicazione: (2025)
di: Lerch, Alexander, et al.
Pubblicazione: (2025)
MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation
di: Song, Yakun, et al.
Pubblicazione: (2025)
di: Song, Yakun, et al.
Pubblicazione: (2025)
AI-Driven Acoustic Voice Biomarker-Based Hierarchical Classification of Benign Laryngeal Voice Disorders from Sustained Vowels
di: Annabestani, Mohsen, et al.
Pubblicazione: (2025)
di: Annabestani, Mohsen, et al.
Pubblicazione: (2025)
Materialistic RIR: Material Conditioned Realistic RIR Generation
di: Saad, Mahnoor Fatima, et al.
Pubblicazione: (2026)
di: Saad, Mahnoor Fatima, et al.
Pubblicazione: (2026)
Morse Code-Enabled Speech Recognition for Individuals with Visual and Hearing Impairments
di: Choudhury, Ritabrata Roy
Pubblicazione: (2024)
di: Choudhury, Ritabrata Roy
Pubblicazione: (2024)
Khala: Scaling Acoustic Token Language Models Toward High-Fidelity Music Generation
di: Liu, Jiafeng, et al.
Pubblicazione: (2026)
di: Liu, Jiafeng, et al.
Pubblicazione: (2026)
Improving Underwater Acoustic Classification Through Learnable Gabor Filter Convolution and Attention Mechanisms
di: Domingos, Lucas Cesar Ferreira, et al.
Pubblicazione: (2025)
di: Domingos, Lucas Cesar Ferreira, et al.
Pubblicazione: (2025)
AUDRON: A Deep Learning Framework with Fused Acoustic Signatures for Drone Type Recognition
di: Chatterjee, Rajdeep, et al.
Pubblicazione: (2025)
di: Chatterjee, Rajdeep, et al.
Pubblicazione: (2025)
Multi-Source Music Generation with Latent Diffusion
di: Xu, Zhongweiyang, et al.
Pubblicazione: (2024)
di: Xu, Zhongweiyang, et al.
Pubblicazione: (2024)
Acoustic Sensing for Universal Jamming Grippers
di: Weber, Lion, et al.
Pubblicazione: (2026)
di: Weber, Lion, et al.
Pubblicazione: (2026)
Sample-Constrained Black Box Optimization for Audio Personalization
di: Rajagopalan, Rajalaxmi, et al.
Pubblicazione: (2025)
di: Rajagopalan, Rajalaxmi, et al.
Pubblicazione: (2025)
Towards Open Respiratory Acoustic Foundation Models: Pretraining and Benchmarking
di: Zhang, Yuwei, et al.
Pubblicazione: (2024)
di: Zhang, Yuwei, et al.
Pubblicazione: (2024)
Music for All: Representational Bias and Cross-Cultural Adaptability of Music Generation Models
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
Model Merging Improves Zero-Shot Generalization in Bioacoustic Foundation Models
di: Marincione, Davide, et al.
Pubblicazione: (2025)
di: Marincione, Davide, et al.
Pubblicazione: (2025)
Explainability of CNN Based Classification Models for Acoustic Signal
di: Faruqui, Zubair, et al.
Pubblicazione: (2025)
di: Faruqui, Zubair, et al.
Pubblicazione: (2025)
Discrete Langevin-Inspired Posterior Sampling
di: Amballa, Chaitanya, et al.
Pubblicazione: (2026)
di: Amballa, Chaitanya, et al.
Pubblicazione: (2026)
Acoustic Identification of Ae. aegypti Mosquitoes using Smartphone Apps and Residual Convolutional Neural Networks
di: Paim, Kayuã Oleques, et al.
Pubblicazione: (2023)
di: Paim, Kayuã Oleques, et al.
Pubblicazione: (2023)
Benchmarking Language Modeling for Lossless Compression of Full-Fidelity Audio
di: Long, Phillip, et al.
Pubblicazione: (2026)
di: Long, Phillip, et al.
Pubblicazione: (2026)
PeriodWave: Multi-Period Flow Matching for High-Fidelity Waveform Generation
di: Lee, Sang-Hoon, et al.
Pubblicazione: (2024)
di: Lee, Sang-Hoon, et al.
Pubblicazione: (2024)
Accelerating High-Fidelity Waveform Generation via Adversarial Flow Matching Optimization
di: Lee, Sang-Hoon, et al.
Pubblicazione: (2024)
di: Lee, Sang-Hoon, et al.
Pubblicazione: (2024)
Back to Ear: Perceptually Driven High Fidelity Music Reconstruction
di: Wang, Kangdi, et al.
Pubblicazione: (2025)
di: Wang, Kangdi, et al.
Pubblicazione: (2025)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
di: Wang, Lu, et al.
Pubblicazione: (2025)
di: Wang, Lu, et al.
Pubblicazione: (2025)
NVSpeech: An Integrated and Scalable Pipeline for Human-Like Speech Modeling with Paralinguistic Vocalizations
di: Liao, Huan, et al.
Pubblicazione: (2025)
di: Liao, Huan, et al.
Pubblicazione: (2025)
QAMRO: Quality-aware Adaptive Margin Ranking Optimization for Human-aligned Assessment of Audio Generation Systems
di: Wang, Chien-Chun, et al.
Pubblicazione: (2025)
di: Wang, Chien-Chun, et al.
Pubblicazione: (2025)
A Survey of Music Generation in the Context of Interaction
di: Agchar, Ismael, et al.
Pubblicazione: (2024)
di: Agchar, Ismael, et al.
Pubblicazione: (2024)
Turn-taking and Backchannel Prediction with Acoustic and Large Language Model Fusion
di: Wang, Jinhan, et al.
Pubblicazione: (2024)
di: Wang, Jinhan, et al.
Pubblicazione: (2024)
DiffEditor: Enhancing Speech Editing with Semantic Enrichment and Acoustic Consistency
di: Chen, Yang, et al.
Pubblicazione: (2024)
di: Chen, Yang, et al.
Pubblicazione: (2024)
DRAGON: Distributional Rewards Optimize Diffusion Generative Models
di: Bai, Yatong, et al.
Pubblicazione: (2025)
di: Bai, Yatong, et al.
Pubblicazione: (2025)
A$^2$-LLM: An End-to-end Conversational Audio Avatar Large Language Model
di: Hu, Xiaolin, et al.
Pubblicazione: (2026)
di: Hu, Xiaolin, et al.
Pubblicazione: (2026)
SafeSpeech: Robust and Universal Voice Protection Against Malicious Speech Synthesis
di: Zhang, Zhisheng, et al.
Pubblicazione: (2025)
di: Zhang, Zhisheng, et al.
Pubblicazione: (2025)
DAFMSVC: One-Shot Singing Voice Conversion with Dual Attention Mechanism and Flow Matching
di: Chen, Wei, et al.
Pubblicazione: (2025)
di: Chen, Wei, et al.
Pubblicazione: (2025)
Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators
di: Novack, Zachary, et al.
Pubblicazione: (2026)
di: Novack, Zachary, et al.
Pubblicazione: (2026)
MARS: Sound Generation via Multi-Channel Autoregression on Spectrograms
di: Ristori, Eleonora, et al.
Pubblicazione: (2025)
di: Ristori, Eleonora, et al.
Pubblicazione: (2025)
EigeNet: Geometry-Informed Multi-Modal Learning for Few-shot Novel View RIR Prediction
di: Jing, Chong, et al.
Pubblicazione: (2026)
di: Jing, Chong, et al.
Pubblicazione: (2026)
DITTO-2: Distilled Diffusion Inference-Time T-Optimization for Music Generation
di: Novack, Zachary, et al.
Pubblicazione: (2024)
di: Novack, Zachary, et al.
Pubblicazione: (2024)
EchoMark: Perceptual Acoustic Environment Transfer with Watermark-Embedded Room Impulse Response
di: Huang, Chenpei, et al.
Pubblicazione: (2025)
di: Huang, Chenpei, et al.
Pubblicazione: (2025)
Missing Melodies: AI Music Generation and its "Nearly" Complete Omission of the Global South
di: Mehta, Atharva, et al.
Pubblicazione: (2024)
di: Mehta, Atharva, et al.
Pubblicazione: (2024)
Of All StrIPEs: Investigating Structure-informed Positional Encoding for Efficient Music Generation
di: Agarwal, Manvi, et al.
Pubblicazione: (2025)
di: Agarwal, Manvi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Whisper-RIR-Mega: A Paired Clean-Reverberant Speech Benchmark for ASR Robustness to Room Acoustics
di: Goswami, Mandip
Pubblicazione: (2026) -
Learning Energy-based Variational Latent Prior for VAEs
di: Dutta, Debottam, et al.
Pubblicazione: (2025) -
Survey on the Evaluation of Generative Models in Music
di: Lerch, Alexander, et al.
Pubblicazione: (2025) -
MagiCodec: Simple Masked Gaussian-Injected Codec for High-Fidelity Reconstruction and Generation
di: Song, Yakun, et al.
Pubblicazione: (2025) -
AI-Driven Acoustic Voice Biomarker-Based Hierarchical Classification of Benign Laryngeal Voice Disorders from Sustained Vowels
di: Annabestani, Mohsen, et al.
Pubblicazione: (2025)