Fully Few-shot Class-incremental Audio Classification Using Expandable Dual-embedding Extractor
Fuente:
arXiv
Salvato in:
| Autori principali: | Si, Yongjie, Li, Yanxiong, Li, Jialong, Tan, Jiaxin, He, Qianhua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fully Few-shot Class-incremental Audio Classification Using Multi-level Embedding Extractor and Ridge Regression Classifier
di: Si, Yongjie, et al.
Pubblicazione: (2025)
di: Si, Yongjie, et al.
Pubblicazione: (2025)
Low-Complexity Acoustic Scene Classification Using Parallel Attention-Convolution Network
di: Li, Yanxiong, et al.
Pubblicazione: (2024)
di: Li, Yanxiong, et al.
Pubblicazione: (2024)
Generalizable Audio Deepfake Detection via Hierarchical Structure Learning and Feature Whitening in Poincaré sphere
di: Yang, Mingru, et al.
Pubblicazione: (2025)
di: Yang, Mingru, et al.
Pubblicazione: (2025)
UniAudio 1.5: Large Language Model-driven Audio Codec is A Few-shot Audio Task Learner
di: Yang, Dongchao, et al.
Pubblicazione: (2024)
di: Yang, Dongchao, et al.
Pubblicazione: (2024)
Towards Robust Few-shot Class Incremental Learning in Audio Classification using Contrastive Representation
di: Singh, Riyansha, et al.
Pubblicazione: (2024)
di: Singh, Riyansha, et al.
Pubblicazione: (2024)
Class-Incremental Learning for Multi-Label Audio Classification
di: Mulimani, Manjunath, et al.
Pubblicazione: (2024)
di: Mulimani, Manjunath, et al.
Pubblicazione: (2024)
Enhancing Zero-shot Audio Classification using Sound Attribute Knowledge from Large Language Models
di: Xu, Xuenan, et al.
Pubblicazione: (2024)
di: Xu, Xuenan, et al.
Pubblicazione: (2024)
AudioCIL: A Python Toolbox for Audio Class-Incremental Learning with Multiple Scenes
di: Xu, Qisheng, et al.
Pubblicazione: (2024)
di: Xu, Qisheng, et al.
Pubblicazione: (2024)
Zero- and Few-shot Sound Event Localization and Detection
di: Shimada, Kazuki, et al.
Pubblicazione: (2023)
di: Shimada, Kazuki, et al.
Pubblicazione: (2023)
AudioBERTScore: Objective Evaluation of Environmental Sound Synthesis Based on Similarity of Audio embedding Sequences
di: Kishi, Minoru, et al.
Pubblicazione: (2025)
di: Kishi, Minoru, et al.
Pubblicazione: (2025)
SemanticAudio: Audio Generation and Editing in Semantic Space
di: Dai, Zheqi, et al.
Pubblicazione: (2026)
di: Dai, Zheqi, et al.
Pubblicazione: (2026)
Vision Language Models Are Few-Shot Audio Spectrogram Classifiers
di: Dixit, Satvik, et al.
Pubblicazione: (2024)
di: Dixit, Satvik, et al.
Pubblicazione: (2024)
Leveraging Self-supervised Audio Representations for Data-Efficient Acoustic Scene Classification
di: Cai, Yiqiang, et al.
Pubblicazione: (2024)
di: Cai, Yiqiang, et al.
Pubblicazione: (2024)
TAME: Temporal Audio-based Mamba for Enhanced Drone Trajectory Estimation and Classification
di: Xiao, Zhenyuan, et al.
Pubblicazione: (2024)
di: Xiao, Zhenyuan, et al.
Pubblicazione: (2024)
OpenBEATs: A Fully Open-Source General-Purpose Audio Encoder
di: Bharadwaj, Shikhar, et al.
Pubblicazione: (2025)
di: Bharadwaj, Shikhar, et al.
Pubblicazione: (2025)
Audio Spotforming Using Nonnegative Tensor Factorization with Attractor-Based Regularization
di: Ayano, Shoma, et al.
Pubblicazione: (2024)
di: Ayano, Shoma, et al.
Pubblicazione: (2024)
Towards zero-shot amplifier modeling: One-to-many amplifier modeling via tone embedding control
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
Joint Training of Speaker Embedding Extractor, Speech and Overlap Detection for Diarization
di: Pálka, Petr, et al.
Pubblicazione: (2024)
di: Pálka, Petr, et al.
Pubblicazione: (2024)
SoundCollage: Automated Discovery of New Classes in Audio Datasets
di: Choi, Ryuhaerang, et al.
Pubblicazione: (2024)
di: Choi, Ryuhaerang, et al.
Pubblicazione: (2024)
Robust Audio Tagging under Class-wise Supervision Unreliability
di: Hou, Yuanbo, et al.
Pubblicazione: (2026)
di: Hou, Yuanbo, et al.
Pubblicazione: (2026)
Disentangling Dual-Encoder Masked Autoencoder for Respiratory Sound Classification
di: Wei, Peidong, et al.
Pubblicazione: (2025)
di: Wei, Peidong, et al.
Pubblicazione: (2025)
Exploring Meta Information for Audio-based Zero-shot Bird Classification
di: Gebhard, Alexander, et al.
Pubblicazione: (2023)
di: Gebhard, Alexander, et al.
Pubblicazione: (2023)
Experimental Results of Underwater Sound Speed Profile Inversion by Few-shot Multi-task Learning
di: Huang, Wei, et al.
Pubblicazione: (2023)
di: Huang, Wei, et al.
Pubblicazione: (2023)
Towards Privacy-Preserving Audio Classification Systems
di: Chhaglani, Bhawana, et al.
Pubblicazione: (2024)
di: Chhaglani, Bhawana, et al.
Pubblicazione: (2024)
Angular Distance Distribution Loss for Audio Classification
di: Almudévar, Antonio, et al.
Pubblicazione: (2024)
di: Almudévar, Antonio, et al.
Pubblicazione: (2024)
AudioEval: Automatic Dual-Perspective and Multi-Dimensional Evaluation of Text-to-Audio-Generation
di: Wang, Hui, et al.
Pubblicazione: (2025)
di: Wang, Hui, et al.
Pubblicazione: (2025)
DualCodec: A Low-Frame-Rate, Semantically-Enhanced Neural Audio Codec for Speech Generation
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
di: Li, Jiaqi, et al.
Pubblicazione: (2025)
PAT: Parameter-Free Audio-Text Aligner to Boost Zero-Shot Audio Classification
di: Seth, Ashish, et al.
Pubblicazione: (2024)
di: Seth, Ashish, et al.
Pubblicazione: (2024)
Zero-Shot Audio Captioning Using Soft and Hard Prompts
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
RBA-FE: A Robust Brain-Inspired Audio Feature Extractor for Depression Diagnosis
di: Wu, Yu-Xuan, et al.
Pubblicazione: (2025)
di: Wu, Yu-Xuan, et al.
Pubblicazione: (2025)
On the Transferability of Large-Scale Self-Supervision to Few-Shot Audio Classification
di: Heggan, Calum, et al.
Pubblicazione: (2024)
di: Heggan, Calum, et al.
Pubblicazione: (2024)
Audio-Based Classification of Insect Species Using Machine Learning Models: Cicada, Beetle, Termite, and Cricket
di: Shetty, Manas V, et al.
Pubblicazione: (2025)
di: Shetty, Manas V, et al.
Pubblicazione: (2025)
Benchmarking Time-localized Explanations for Audio Classification Models
di: Bolaños, Cecilia, et al.
Pubblicazione: (2025)
di: Bolaños, Cecilia, et al.
Pubblicazione: (2025)
Advancing Continual Learning for Robust Deepfake Audio Classification
di: Dong, Feiyi, et al.
Pubblicazione: (2024)
di: Dong, Feiyi, et al.
Pubblicazione: (2024)
Wav2Prompt: End-to-End Speech Prompt Generation and Tuning For LLM in Zero and Few-shot Learning
di: Deng, Keqi, et al.
Pubblicazione: (2024)
di: Deng, Keqi, et al.
Pubblicazione: (2024)
The ICME 2025 Audio Encoder Capability Challenge
di: Zhang, Junbo, et al.
Pubblicazione: (2025)
di: Zhang, Junbo, et al.
Pubblicazione: (2025)
SRC-gAudio: Sampling-Rate-Controlled Audio Generation
di: Li, Chenxing, et al.
Pubblicazione: (2024)
di: Li, Chenxing, et al.
Pubblicazione: (2024)
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
di: Gong, Yitian, et al.
Pubblicazione: (2026)
di: Gong, Yitian, et al.
Pubblicazione: (2026)
MiMo-Audio: Audio Language Models are Few-Shot Learners
di: Core Team, et al.
Pubblicazione: (2025)
di: Core Team, et al.
Pubblicazione: (2025)
UniAudio: An Audio Foundation Model Toward Universal Audio Generation
di: Yang, Dongchao, et al.
Pubblicazione: (2023)
di: Yang, Dongchao, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Fully Few-shot Class-incremental Audio Classification Using Multi-level Embedding Extractor and Ridge Regression Classifier
di: Si, Yongjie, et al.
Pubblicazione: (2025) -
Low-Complexity Acoustic Scene Classification Using Parallel Attention-Convolution Network
di: Li, Yanxiong, et al.
Pubblicazione: (2024) -
Generalizable Audio Deepfake Detection via Hierarchical Structure Learning and Feature Whitening in Poincaré sphere
di: Yang, Mingru, et al.
Pubblicazione: (2025) -
UniAudio 1.5: Large Language Model-driven Audio Codec is A Few-shot Audio Task Learner
di: Yang, Dongchao, et al.
Pubblicazione: (2024) -
Towards Robust Few-shot Class Incremental Learning in Audio Classification using Contrastive Representation
di: Singh, Riyansha, et al.
Pubblicazione: (2024)