An Investigation of Test-time Adaptation for Audio Classification under Background Noise
Fuente:
arXiv
Guardado en:
| Autores principales: | Shao, Weichuang, Liao, Iman Yi, Maul, Tomas Henrique Bode, Chandesa, Tissa |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DHAuDS: A Dynamic and Heterogeneous Audio Benchmark for Test-Time Adaptation
por: Shao, Weichuang, et al.
Publicado: (2025)
por: Shao, Weichuang, et al.
Publicado: (2025)
AMAuT: A Flexible and Efficient Multiview Audio Transformer Framework Trained from Scratch
por: Shao, Weichuang, et al.
Publicado: (2025)
por: Shao, Weichuang, et al.
Publicado: (2025)
Advancing Audio Fingerprinting Accuracy Addressing Background Noise and Distortion Challenges
por: Kamuni, Navin, et al.
Publicado: (2024)
por: Kamuni, Navin, et al.
Publicado: (2024)
SSNAPS: Audio-Visual Separation of Speech and Background Noise with Diffusion Inverse Sampling
por: Yemini, Yochai, et al.
Publicado: (2026)
por: Yemini, Yochai, et al.
Publicado: (2026)
An Unsupervised Domain Adaptation Method for Locating Manipulated Region in partially fake Audio
por: Zeng, Siding, et al.
Publicado: (2024)
por: Zeng, Siding, et al.
Publicado: (2024)
Leveraging Self-supervised Audio Representations for Data-Efficient Acoustic Scene Classification
por: Cai, Yiqiang, et al.
Publicado: (2024)
por: Cai, Yiqiang, et al.
Publicado: (2024)
Advancing Test-Time Adaptation in Wild Acoustic Test Settings
por: Liu, Hongfu, et al.
Publicado: (2023)
por: Liu, Hongfu, et al.
Publicado: (2023)
Audio Processing using Pattern Recognition for Music Genre Classification
por: Chatterjee, Sivangi, et al.
Publicado: (2024)
por: Chatterjee, Sivangi, et al.
Publicado: (2024)
Multi-label Zero-Shot Audio Classification with Temporal Attention
por: Dogan, Duygu, et al.
Publicado: (2024)
por: Dogan, Duygu, et al.
Publicado: (2024)
Test-Time Adaptation for Speech Emotion Recognition
por: Dong, Jiaheng, et al.
Publicado: (2026)
por: Dong, Jiaheng, et al.
Publicado: (2026)
Domain Adaptation for Contrastive Audio-Language Models
por: Deshmukh, Soham, et al.
Publicado: (2024)
por: Deshmukh, Soham, et al.
Publicado: (2024)
Audio Classification of Low Feature Spectrograms Utilizing Convolutional Neural Networks
por: Elias, Noel
Publicado: (2024)
por: Elias, Noel
Publicado: (2024)
On the Transferability of Large-Scale Self-Supervision to Few-Shot Audio Classification
por: Heggan, Calum, et al.
Publicado: (2024)
por: Heggan, Calum, et al.
Publicado: (2024)
Multimodal Attention Merging for Improved Speech Recognition and Audio Event Classification
por: Sundar, Anirudh S., et al.
Publicado: (2023)
por: Sundar, Anirudh S., et al.
Publicado: (2023)
Exploring Meta Information for Audio-based Zero-shot Bird Classification
por: Gebhard, Alexander, et al.
Publicado: (2023)
por: Gebhard, Alexander, et al.
Publicado: (2023)
Investigating Group Relative Policy Optimization for Diffusion Transformer based Text-to-Audio Generation
por: Gu, Yi, et al.
Publicado: (2026)
por: Gu, Yi, et al.
Publicado: (2026)
Patch-Mix Contrastive Learning with Audio Spectrogram Transformer on Respiratory Sound Classification
por: Bae, Sangmin, et al.
Publicado: (2023)
por: Bae, Sangmin, et al.
Publicado: (2023)
Continual Test-time Adaptation for End-to-end Speech Recognition on Noisy Speech
por: Lin, Guan-Ting, et al.
Publicado: (2024)
por: Lin, Guan-Ting, et al.
Publicado: (2024)
Towards Privacy-Preserving Audio Classification Systems
por: Chhaglani, Bhawana, et al.
Publicado: (2024)
por: Chhaglani, Bhawana, et al.
Publicado: (2024)
Angular Distance Distribution Loss for Audio Classification
por: Almudévar, Antonio, et al.
Publicado: (2024)
por: Almudévar, Antonio, et al.
Publicado: (2024)
PAT: Parameter-Free Audio-Text Aligner to Boost Zero-Shot Audio Classification
por: Seth, Ashish, et al.
Publicado: (2024)
por: Seth, Ashish, et al.
Publicado: (2024)
Thinking While Listening: Simple Test Time Scaling For Audio Classification
por: Verma, Prateek, et al.
Publicado: (2025)
por: Verma, Prateek, et al.
Publicado: (2025)
Towards Robust Few-shot Class Incremental Learning in Audio Classification using Contrastive Representation
por: Singh, Riyansha, et al.
Publicado: (2024)
por: Singh, Riyansha, et al.
Publicado: (2024)
Audio Simulation for Sound Source Localization in Virtual Evironment
por: Di Yuan, Yi, et al.
Publicado: (2024)
por: Di Yuan, Yi, et al.
Publicado: (2024)
Noise-to-mask Ratio Loss for Deep Neural Network based Audio Watermarking
por: Moritz, Martin, et al.
Publicado: (2024)
por: Moritz, Martin, et al.
Publicado: (2024)
Benchmarking Time-localized Explanations for Audio Classification Models
por: Bolaños, Cecilia, et al.
Publicado: (2025)
por: Bolaños, Cecilia, et al.
Publicado: (2025)
Class-Incremental Learning for Multi-Label Audio Classification
por: Mulimani, Manjunath, et al.
Publicado: (2024)
por: Mulimani, Manjunath, et al.
Publicado: (2024)
Advancing Continual Learning for Robust Deepfake Audio Classification
por: Dong, Feiyi, et al.
Publicado: (2024)
por: Dong, Feiyi, et al.
Publicado: (2024)
Bringing the Discussion of Minima Sharpness to the Audio Domain: a Filter-Normalised Evaluation for Acoustic Scene Classification
por: Milling, Manuel, et al.
Publicado: (2023)
por: Milling, Manuel, et al.
Publicado: (2023)
E-BATS: Efficient Backpropagation-Free Test-Time Adaptation for Speech Foundation Models
por: Dong, Jiaheng, et al.
Publicado: (2025)
por: Dong, Jiaheng, et al.
Publicado: (2025)
Structural and Statistical Audio Texture Knowledge Distillation for Acoustic Classification
por: Ritu, Jarin, et al.
Publicado: (2025)
por: Ritu, Jarin, et al.
Publicado: (2025)
Hyperbolic Embeddings for Order-Aware Classification of Audio Effect Chains
por: Wada, Aogu, et al.
Publicado: (2025)
por: Wada, Aogu, et al.
Publicado: (2025)
Variable Bitrate Residual Vector Quantization for Audio Coding
por: Chae, Yunkee, et al.
Publicado: (2024)
por: Chae, Yunkee, et al.
Publicado: (2024)
A2SB: Audio-to-Audio Schrodinger Bridges
por: Kong, Zhifeng, et al.
Publicado: (2025)
por: Kong, Zhifeng, et al.
Publicado: (2025)
InterGridNet: An Electric Network Frequency Approach for Audio Source Location Classification Using Convolutional Neural Networks
por: Korgialas, Christos, et al.
Publicado: (2025)
por: Korgialas, Christos, et al.
Publicado: (2025)
Trainingless Adaptation of Pretrained Models for Environmental Sound Classification
por: Tonami, Noriyuki, et al.
Publicado: (2024)
por: Tonami, Noriyuki, et al.
Publicado: (2024)
Fx-Encoder++: Extracting Instrument-Wise Audio Effects Representations from Mixtures
por: Yeh, Yen-Tung, et al.
Publicado: (2025)
por: Yeh, Yen-Tung, et al.
Publicado: (2025)
TACOS: Temporally-aligned Audio CaptiOnS for Language-Audio Pretraining
por: Primus, Paul, et al.
Publicado: (2025)
por: Primus, Paul, et al.
Publicado: (2025)
Zero Shot Audio to Audio Emotion Transfer With Speaker Disentanglement
por: Dutta, Soumya, et al.
Publicado: (2024)
por: Dutta, Soumya, et al.
Publicado: (2024)
ASGIR: Audio Spectrogram Transformer Guided Classification And Information Retrieval For Birds
por: Chaudhuri, Yashwardhan, et al.
Publicado: (2024)
por: Chaudhuri, Yashwardhan, et al.
Publicado: (2024)
Ejemplares similares
-
DHAuDS: A Dynamic and Heterogeneous Audio Benchmark for Test-Time Adaptation
por: Shao, Weichuang, et al.
Publicado: (2025) -
AMAuT: A Flexible and Efficient Multiview Audio Transformer Framework Trained from Scratch
por: Shao, Weichuang, et al.
Publicado: (2025) -
Advancing Audio Fingerprinting Accuracy Addressing Background Noise and Distortion Challenges
por: Kamuni, Navin, et al.
Publicado: (2024) -
SSNAPS: Audio-Visual Separation of Speech and Background Noise with Diffusion Inverse Sampling
por: Yemini, Yochai, et al.
Publicado: (2026) -
An Unsupervised Domain Adaptation Method for Locating Manipulated Region in partially fake Audio
por: Zeng, Siding, et al.
Publicado: (2024)