Enregistré dans:
| Auteurs principaux: | Tan, Ee-Leng, Karnapi, Furi Andi, Ng, Linus Junjia, Ooi, Kenneth, Gan, Woon-Seng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2408.05721 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Stereo 3D Sound Event Localization and Detection: Perceptual Features, Stereo-specific Data Augmentation, and Distance Normalization
par: Yeow, Jun-Wei, et autres
Publié: (2025)
par: Yeow, Jun-Wei, et autres
Publié: (2025)
MAGENTA: Magnitude and Geometry-ENhanced Training Approach for Robust Long-Tailed Sound Event Localization and Detection
par: Yeow, Jun-Wei, et autres
Publié: (2025)
par: Yeow, Jun-Wei, et autres
Publié: (2025)
Squeeze-and-Excite ResNet-Conformers for Sound Event Localization, Detection, and Distance Estimation for DCASE 2024 Challenge
par: Yeow, Jun Wei, et autres
Publié: (2024)
par: Yeow, Jun Wei, et autres
Publié: (2024)
Enhancing Situational Awareness in Wearable Audio Devices Using a Lightweight Sound Event Localization and Detection System
par: Yeow, Jun-Wei, et autres
Publié: (2025)
par: Yeow, Jun-Wei, et autres
Publié: (2025)
Transformer-based End-to-End Control Filter Generation for Active Noise Control
par: Yang, Ziyi, et autres
Publié: (2026)
par: Yang, Ziyi, et autres
Publié: (2026)
Automating Urban Soundscape Enhancements with AI: In-situ Assessment of Quality and Restorativeness in Traffic-Exposed Residential Areas
par: Lam, Bhan, et autres
Publié: (2024)
par: Lam, Bhan, et autres
Publié: (2024)
ARAUS: A Large-Scale Dataset and Baseline Models of Affective Responses to Augmented Urban Soundscapes
par: Ooi, Kenneth, et autres
Publié: (2022)
par: Ooi, Kenneth, et autres
Publié: (2022)
Acoustic Scene Classification Using CNN-GRU Model Without Knowledge Distillation
par: Tan, Ee-Leng, et autres
Publié: (2025)
par: Tan, Ee-Leng, et autres
Publié: (2025)
Autonomous Soundscape Augmentation with Multimodal Fusion of Visual and Participant-linked Inputs
par: Ooi, Kenneth, et autres
Publié: (2023)
par: Ooi, Kenneth, et autres
Publié: (2023)
Data Efficient Acoustic Scene Classification using Teacher-Informed Confusing Class Instruction
par: Yeo, Jin Jie Sean, et autres
Publié: (2024)
par: Yeo, Jin Jie Sean, et autres
Publié: (2024)
Joint Feature and Output Distillation for Low-complexity Acoustic Scene Classification
par: Li, Haowen, et autres
Publié: (2025)
par: Li, Haowen, et autres
Publié: (2025)
Do neonates hear what we measure? Assessing neonatal ward soundscapes at the neonates ears
par: Lam, Bhan, et autres
Publié: (2025)
par: Lam, Bhan, et autres
Publié: (2025)
FRCRN: Boosting Feature Representation using Frequency Recurrence for Monaural Speech Enhancement
par: Zhao, Shengkui, et autres
Publié: (2022)
par: Zhao, Shengkui, et autres
Publié: (2022)
Mixed-gradients Distributed Filtered Reference Least Mean Square Algorithm -- A Robust Distributed Multichannel Active Noise Control Algorithm
par: Ji, Junwei, et autres
Publié: (2025)
par: Ji, Junwei, et autres
Publié: (2025)
IoT-based Noise Monitoring using Mobile Nodes for Smart Cities
par: Manthina, Bhima Sankar, et autres
Publié: (2025)
par: Manthina, Bhima Sankar, et autres
Publié: (2025)
Self-Boosted Weight-Constrained FxLMS: A Robustness Distributed Active Noise Control Algorithm Without Internode Communication
par: Ji, Junwei, et autres
Publié: (2025)
par: Ji, Junwei, et autres
Publié: (2025)
Sub-band and Full-band Interactive U-Net with DPRNN for Demixing Cross-talk Stereo Music
par: Yin, Han, et autres
Publié: (2024)
par: Yin, Han, et autres
Publié: (2024)
A Stabilized Hybrid Active Noise Control Algorithm of GFANC and FxNLMS with Online Clustering
par: Luo, Zhengding, et autres
Publié: (2026)
par: Luo, Zhengding, et autres
Publié: (2026)
AudioLog: LLMs-Powered Long Audio Logging with Hybrid Token-Semantic Contrastive Learning
par: Bai, Jisheng, et autres
Publié: (2023)
par: Bai, Jisheng, et autres
Publié: (2023)
Period Singer: Integrating Periodic and Aperiodic Variational Autoencoders for Natural-Sounding End-to-End Singing Voice Synthesis
par: Kim, Taewoo, et autres
Publié: (2024)
par: Kim, Taewoo, et autres
Publié: (2024)
VBx for End-to-End Neural and Clustering-based Diarization
par: Pálka, Petr, et autres
Publié: (2025)
par: Pálka, Petr, et autres
Publié: (2025)
DNCASR: End-to-End Training for Speaker-Attributed ASR
par: Zheng, Xianrui, et autres
Publié: (2025)
par: Zheng, Xianrui, et autres
Publié: (2025)
Disambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-trained BERT
par: Dai, Dongyang, et autres
Publié: (2025)
par: Dai, Dongyang, et autres
Publié: (2025)
An End-To-End Stuttering Detection Method Based On Conformer And BILSTM
par: Liu, Xiaokang, et autres
Publié: (2024)
par: Liu, Xiaokang, et autres
Publié: (2024)
Distributed Multichannel Active Noise Control with Asynchronous Communication
par: Ji, Junwei, et autres
Publié: (2026)
par: Ji, Junwei, et autres
Publié: (2026)
Transferable Selective Virtual Sensing Active Noise Control Technique Based on Metric Learning
par: Wang, Boxiang, et autres
Publié: (2024)
par: Wang, Boxiang, et autres
Publié: (2024)
Predictive Directional Selective Fixed-Filter Active Noise Control for Moving Sources via a Convolutional Recurrent Neural Network
par: Wang, Boxiang, et autres
Publié: (2026)
par: Wang, Boxiang, et autres
Publié: (2026)
A Real-Time Platform for Portable and Scalable Active Noise Mitigation for Construction Machinery
par: Gan, Woon-Seng, et autres
Publié: (2024)
par: Gan, Woon-Seng, et autres
Publié: (2024)
End-to-End Speech Recognition with Pre-trained Masked Language Model
par: Higuchi, Yosuke, et autres
Publié: (2024)
par: Higuchi, Yosuke, et autres
Publié: (2024)
AudioSetCaps: An Enriched Audio-Caption Dataset using Automated Generation Pipeline with Large Audio and Language Models
par: Bai, Jisheng, et autres
Publié: (2024)
par: Bai, Jisheng, et autres
Publié: (2024)
End-to-End Direction-Aware Keyword Spotting with Spatial Priors in Noisy Environments
par: Wang, Rui, et autres
Publié: (2026)
par: Wang, Rui, et autres
Publié: (2026)
End-to-End DOA-Guided Speech Extraction in Noisy Multi-Talker Scenarios
par: Jing, Kangqi, et autres
Publié: (2025)
par: Jing, Kangqi, et autres
Publié: (2025)
Using Adapters to Overcome Catastrophic Forgetting in End-to-End Automatic Speech Recognition
par: Eeckt, Steven Vander, et autres
Publié: (2022)
par: Eeckt, Steven Vander, et autres
Publié: (2022)
End-to-End Diarization utilizing Attractor Deep Clustering
par: Palzer, David, et autres
Publié: (2025)
par: Palzer, David, et autres
Publié: (2025)
Speaker Adaptation for Quantised End-to-End ASR Models
par: Zhao, Qiuming, et autres
Publié: (2024)
par: Zhao, Qiuming, et autres
Publié: (2024)
An Investigation on Speaker Augmentation for End-to-End Speaker Extraction
par: You, Zhenghai, et autres
Publié: (2025)
par: You, Zhenghai, et autres
Publié: (2025)
Lightweight and Robust Multi-Channel End-to-End Speech Recognition with Spherical Harmonic Transform
par: Kong, Xiangzhu, et autres
Publié: (2025)
par: Kong, Xiangzhu, et autres
Publié: (2025)
Dissecting the Segmentation Model of End-to-End Diarization with Vector Clustering
par: Plaquet, Alexis, et autres
Publié: (2025)
par: Plaquet, Alexis, et autres
Publié: (2025)
A Robust Proactive Communication Strategy for Distributed Active Noise Control Systems
par: Ji, Junwei, et autres
Publié: (2025)
par: Ji, Junwei, et autres
Publié: (2025)
Reference Channel Selection by Multi-Channel Masking for End-to-End Multi-Channel Speech Enhancement
par: Dai, Wang, et autres
Publié: (2024)
par: Dai, Wang, et autres
Publié: (2024)
Documents similaires
-
Improving Stereo 3D Sound Event Localization and Detection: Perceptual Features, Stereo-specific Data Augmentation, and Distance Normalization
par: Yeow, Jun-Wei, et autres
Publié: (2025) -
MAGENTA: Magnitude and Geometry-ENhanced Training Approach for Robust Long-Tailed Sound Event Localization and Detection
par: Yeow, Jun-Wei, et autres
Publié: (2025) -
Squeeze-and-Excite ResNet-Conformers for Sound Event Localization, Detection, and Distance Estimation for DCASE 2024 Challenge
par: Yeow, Jun Wei, et autres
Publié: (2024) -
Enhancing Situational Awareness in Wearable Audio Devices Using a Lightweight Sound Event Localization and Detection System
par: Yeow, Jun-Wei, et autres
Publié: (2025) -
Transformer-based End-to-End Control Filter Generation for Active Noise Control
par: Yang, Ziyi, et autres
Publié: (2026)