Exploring the Power of Pure Attention Mechanisms in Blind Room Parameter Estimation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Chunxi, Jia, Maoshen, Li, Meiran, Bao, Changchun, Jin, Wenyu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SS-BRPE: Self-Supervised Blind Room Parameter Estimation Using Attention Mechanisms
par: Wang, Chunxi, et autres
Publié: (2024)
par: Wang, Chunxi, et autres
Publié: (2024)
DARAS: Dynamic Audio-Room Acoustic Synthesis for Blind Room Impulse Response Estimation
par: Wang, Chunxi, et autres
Publié: (2025)
par: Wang, Chunxi, et autres
Publié: (2025)
Speech Enhancement with Dual-path Multi-Channel Linear Prediction Filter and Multi-norm Beamforming
par: Qin, Chengyuan, et autres
Publié: (2025)
par: Qin, Chengyuan, et autres
Publié: (2025)
BERP: A Blind Estimator of Room Parameters for Single-Channel Noisy Speech Signals
par: Wang, Lijun, et autres
Publié: (2024)
par: Wang, Lijun, et autres
Publié: (2024)
Blind Acoustic Parameter Estimation Through Task-Agnostic Embeddings Using Latent Approximations
par: Götz, Philipp, et autres
Publié: (2024)
par: Götz, Philipp, et autres
Publié: (2024)
Target Speaker Extraction by Directly Exploiting Contextual Information in the Time-Frequency Domain
par: Yang, Xue, et autres
Publié: (2024)
par: Yang, Xue, et autres
Publié: (2024)
Blind Identification of Binaural Room Impulse Responses from Smart Glasses
par: Deppisch, Thomas, et autres
Publié: (2024)
par: Deppisch, Thomas, et autres
Publié: (2024)
Blind Localization of Early Room Reflections with Arbitrary Microphone Array
par: Hadadi, Yogev, et autres
Publié: (2024)
par: Hadadi, Yogev, et autres
Publié: (2024)
Rec-RIR: Monaural Blind Room Impulse Response Identification via DNN-based Reverberant Speech Reconstruction in STFT Domain
par: Wang, Pengyu, et autres
Publié: (2025)
par: Wang, Pengyu, et autres
Publié: (2025)
Unsupervised Blind Joint Dereverberation and Room Acoustics Estimation with Diffusion Models
par: Lemercier, Jean-Marie, et autres
Publié: (2024)
par: Lemercier, Jean-Marie, et autres
Publié: (2024)
Room Impulse Response Generation Conditioned on Acoustic Parameters
par: Arellano, Silvia, et autres
Publié: (2025)
par: Arellano, Silvia, et autres
Publié: (2025)
Scene-wide Acoustic Parameter Estimation
par: Falcon-Perez, Ricardo, et autres
Publié: (2024)
par: Falcon-Perez, Ricardo, et autres
Publié: (2024)
AnyRIR: Robust Non-intrusive Room Impulse Response Estimation in the Wild
par: Lee, Kyung Yun, et autres
Publié: (2025)
par: Lee, Kyung Yun, et autres
Publié: (2025)
Blind Capon Beamformer Based on Independent Component Extraction: Single-Parameter Algorithm,
par: Koldovský, Zbyněk, et autres
Publié: (2025)
par: Koldovský, Zbyněk, et autres
Publié: (2025)
Determined Blind Source Separation with Sinkhorn Divergence-based Optimal Allocation of the Source Power
par: Wang, Jianyu, et autres
Publié: (2025)
par: Wang, Jianyu, et autres
Publié: (2025)
State-Space Estimation of Spatially Dynamic Room Impulse Responses using a Room Acoustic Model-based Prior
par: MacWilliam, Kathleen, et autres
Publié: (2024)
par: MacWilliam, Kathleen, et autres
Publié: (2024)
How Attention Shapes Emotion: A Comparative Study of Attention Mechanisms for Speech Emotion Recognition
par: Casals-Salvador, Marc, et autres
Publié: (2026)
par: Casals-Salvador, Marc, et autres
Publié: (2026)
Room Impulse Response Estimation through Optimal Mass Transport Barycenters
par: Pallewela, Rumeshika, et autres
Publié: (2025)
par: Pallewela, Rumeshika, et autres
Publié: (2025)
Multimodal Deep Learning Method for Real-Time Spatial Room Impulse Response Computing
par: Li, Zhiyu, et autres
Publié: (2026)
par: Li, Zhiyu, et autres
Publié: (2026)
Closed-Form Successive Relative Transfer Function Vector Estimation based on Blind Oblique Projection Incorporating Noise Whitening
par: Gode, Henri, et autres
Publié: (2025)
par: Gode, Henri, et autres
Publié: (2025)
Room Impulse Response Estimation using Optimal Transport: Simulation-Informed Inference
par: Sundström, David, et autres
Publié: (2024)
par: Sundström, David, et autres
Publié: (2024)
Speech Emotion Recognition Via CNN-Transformer and Multidimensional Attention Mechanism
par: Tang, Xiaoyu, et autres
Publié: (2024)
par: Tang, Xiaoyu, et autres
Publié: (2024)
MEAN-RIR: Multi-Modal Environment-Aware Network for Robust Room Impulse Response Estimation
par: Chen, Jiajian, et autres
Publié: (2025)
par: Chen, Jiajian, et autres
Publié: (2025)
Deep Room Impulse Response Completion
par: Lin, Jackie, et autres
Publié: (2024)
par: Lin, Jackie, et autres
Publié: (2024)
MVANet: Multi-Stage Video Attention Network for Sound Event Localization and Detection with Source Distance Estimation
par: Hong, Hengyi, et autres
Publié: (2024)
par: Hong, Hengyi, et autres
Publié: (2024)
Generative Data Augmentation Challenge: Synthesis of Room Acoustics for Speaker Distance Estimation
par: Lin, Jackie, et autres
Publié: (2025)
par: Lin, Jackie, et autres
Publié: (2025)
Single Channel Blind Dereverberation of Speech Signals
par: Nigam, Dhruv
Publié: (2025)
par: Nigam, Dhruv
Publié: (2025)
Joint Multi-scale Cross-lingual Speaking Style Transfer with Bidirectional Attention Mechanism for Automatic Dubbing
par: Li, Jingbei, et autres
Publié: (2023)
par: Li, Jingbei, et autres
Publié: (2023)
Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework
par: Yang, Hsiang-Cheng, et autres
Publié: (2026)
par: Yang, Hsiang-Cheng, et autres
Publié: (2026)
Semi-Blind Channel Estimation and Hybrid Receiver Beamforming in the Tera-Hertz Multi-User Massive MIMO Uplink
par: Garg, Abhisha, et autres
Publié: (2026)
par: Garg, Abhisha, et autres
Publié: (2026)
Room compensation for loudspeaker reproduction using a supporting source
par: Brooks-Park, James, et autres
Publié: (2026)
par: Brooks-Park, James, et autres
Publié: (2026)
Blind Spatial Impulse Response Generation from Separate Room- and Scene-Specific Information
par: Lluís, Francesc, et autres
Publié: (2024)
par: Lluís, Francesc, et autres
Publié: (2024)
Diminishing Domain Mismatch for DNN-Based Acoustic Distance Estimation via Stochastic Room Reverberation Models
par: Gburrek, Tobias, et autres
Publié: (2024)
par: Gburrek, Tobias, et autres
Publié: (2024)
Pureformer-VC: Non-parallel Voice Conversion with Pure Stylized Transformer Blocks and Triplet Discriminative Training
par: Yao, Wenhan, et autres
Publié: (2025)
par: Yao, Wenhan, et autres
Publié: (2025)
Adapting a Text-to-Audio Model for Room Impulse Response Generation
par: Kim, Kirak, et autres
Publié: (2026)
par: Kim, Kirak, et autres
Publié: (2026)
Towards Effective and Efficient Non-autoregressive decoders for Conformer and LLM-based ASR using Block-based Attention Mask
par: Wang, Tianzi, et autres
Publié: (2025)
par: Wang, Tianzi, et autres
Publié: (2025)
Towards Blind Data Cleaning: A Case Study in Music Source Separation
par: Gui, Azalea, et autres
Publié: (2025)
par: Gui, Azalea, et autres
Publié: (2025)
Determined Multichannel Blind Source Separation with Clustered Source Model
par: Wang, Jianyu, et autres
Publié: (2024)
par: Wang, Jianyu, et autres
Publié: (2024)
Blind Estimation of Sub-band Acoustic Parameters from Ambisonics Recordings using Spectro-Spatial Covariance Features
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
Learning Filters in Feedback Delay Networks from Noisy Room Impulse Responses
par: Santo, Gloria Dal, et autres
Publié: (2025)
par: Santo, Gloria Dal, et autres
Publié: (2025)
Documents similaires
-
SS-BRPE: Self-Supervised Blind Room Parameter Estimation Using Attention Mechanisms
par: Wang, Chunxi, et autres
Publié: (2024) -
DARAS: Dynamic Audio-Room Acoustic Synthesis for Blind Room Impulse Response Estimation
par: Wang, Chunxi, et autres
Publié: (2025) -
Speech Enhancement with Dual-path Multi-Channel Linear Prediction Filter and Multi-norm Beamforming
par: Qin, Chengyuan, et autres
Publié: (2025) -
BERP: A Blind Estimator of Room Parameters for Single-Channel Noisy Speech Signals
par: Wang, Lijun, et autres
Publié: (2024) -
Blind Acoustic Parameter Estimation Through Task-Agnostic Embeddings Using Latent Approximations
par: Götz, Philipp, et autres
Publié: (2024)