Online incremental learning for audio classification using a pretrained audio model
Fuente:
arXiv
Guardado en:
| Autores principales: | Mulimani, Manjunath, Mesaros, Annamaria |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Online Domain-Incremental Learning Approach to Classify Acoustic Scenes in All Locations
por: Mulimani, Manjunath, et al.
Publicado: (2024)
por: Mulimani, Manjunath, et al.
Publicado: (2024)
Domain-Incremental Learning for Audio Classification
por: Mulimani, Manjunath, et al.
Publicado: (2024)
por: Mulimani, Manjunath, et al.
Publicado: (2024)
Class-Incremental Learning for Multi-Label Audio Classification
por: Mulimani, Manjunath, et al.
Publicado: (2024)
por: Mulimani, Manjunath, et al.
Publicado: (2024)
Sound event detection with audio-text models and heterogeneous temporal annotations
por: Harju, Manu, et al.
Publicado: (2025)
por: Harju, Manu, et al.
Publicado: (2025)
Incremental learning for audio classification with Hebbian Deep Neural Networks
por: Casciotti, Riccardo, et al.
Publicado: (2026)
por: Casciotti, Riccardo, et al.
Publicado: (2026)
Class-Incremental Learning for Sound Event Localization and Detection
por: Pandey, Ruchi, et al.
Publicado: (2024)
por: Pandey, Ruchi, et al.
Publicado: (2024)
Positive and negative sampling strategies for self-supervised learning on audio-video data
por: Wang, Shanshan, et al.
Publicado: (2024)
por: Wang, Shanshan, et al.
Publicado: (2024)
Domain-Agnostic Incremental Learning for Sound Classification. A DCASE 2026 Challenge task
por: Casciotti, Riccardo, et al.
Publicado: (2026)
por: Casciotti, Riccardo, et al.
Publicado: (2026)
Scaling up masked audio encoder learning for general audio classification
por: Dinkel, Heinrich, et al.
Publicado: (2024)
por: Dinkel, Heinrich, et al.
Publicado: (2024)
Human-CLAP: Human-perception-based contrastive language-audio pretraining
por: Takano, Taisei, et al.
Publicado: (2025)
por: Takano, Taisei, et al.
Publicado: (2025)
Multi-label audio classification with a noisy zero-shot teacher
por: Braun, Sebastian, et al.
Publicado: (2024)
por: Braun, Sebastian, et al.
Publicado: (2024)
GLAP: General contrastive audio-text pretraining across domains and languages
por: Dinkel, Heinrich, et al.
Publicado: (2025)
por: Dinkel, Heinrich, et al.
Publicado: (2025)
Synthetic training set generation using text-to-audio models for environmental sound classification
por: Ronchini, Francesca, et al.
Publicado: (2024)
por: Ronchini, Francesca, et al.
Publicado: (2024)
Towards audio language modeling -- an overview
por: Wu, Haibin, et al.
Publicado: (2024)
por: Wu, Haibin, et al.
Publicado: (2024)
WavLM model ensemble for audio deepfake detection
por: Combei, David, et al.
Publicado: (2024)
por: Combei, David, et al.
Publicado: (2024)
Speaker anonymization using neural audio codec language models
por: Panariello, Michele, et al.
Publicado: (2023)
por: Panariello, Michele, et al.
Publicado: (2023)
Are audio DeepFake detection models polyglots?
por: Marek, Bartłomiej, et al.
Publicado: (2024)
por: Marek, Bartłomiej, et al.
Publicado: (2024)
Understanding the strengths and weaknesses of SSL models for audio deepfake model attribution
por: Pîrlogeanu, Gabriel, et al.
Publicado: (2026)
por: Pîrlogeanu, Gabriel, et al.
Publicado: (2026)
SCORE: Scaling audio generation using Standardized COmposite REwards
por: Jung, Jaemin, et al.
Publicado: (2025)
por: Jung, Jaemin, et al.
Publicado: (2025)
Decodable but not structured: linear probing enables Underwater Acoustic Target Recognition with pretrained audio embeddings
por: Hummel, Hilde I., et al.
Publicado: (2026)
por: Hummel, Hilde I., et al.
Publicado: (2026)
AudioMorphix: Training-free audio editing with diffusion probabilistic models
por: Liang, Jinhua, et al.
Publicado: (2025)
por: Liang, Jinhua, et al.
Publicado: (2025)
WavJEPA: Semantic learning unlocks robust audio foundation models for raw waveforms
por: Yuksel, Goksenin, et al.
Publicado: (2025)
por: Yuksel, Goksenin, et al.
Publicado: (2025)
Deep learning based spatial aliasing reduction in beamforming for audio capture
por: Guzik, Mateusz, et al.
Publicado: (2025)
por: Guzik, Mateusz, et al.
Publicado: (2025)
AxLSTMs: learning self-supervised audio representations with xLSTMs
por: Yadav, Sarthak, et al.
Publicado: (2024)
por: Yadav, Sarthak, et al.
Publicado: (2024)
Cryfish: On deep audio analysis with Large Language Models
por: Mitrofanov, Anton, et al.
Publicado: (2025)
por: Mitrofanov, Anton, et al.
Publicado: (2025)
Multiple Hankel matrix rank minimization for audio inpainting
por: Záviška, Pavel, et al.
Publicado: (2023)
por: Záviška, Pavel, et al.
Publicado: (2023)
Real-time speech enhancement in noise for throat microphone using neural audio codec as foundation model
por: Hauret, Julien, et al.
Publicado: (2025)
por: Hauret, Julien, et al.
Publicado: (2025)
Self-supervised learning method using multiple sampling strategies for general-purpose audio representation
por: Kuroyanagi, Ibuki, et al.
Publicado: (2025)
por: Kuroyanagi, Ibuki, et al.
Publicado: (2025)
Regularized autoregressive modeling and its application to audio signal reconstruction
por: Mokrý, Ondřej, et al.
Publicado: (2024)
por: Mokrý, Ondřej, et al.
Publicado: (2024)
Meta-learning-based percussion transcription and $t\bar{a}la$ identification from low-resource audio
por: Kodag, Rahul Bapusaheb, et al.
Publicado: (2025)
por: Kodag, Rahul Bapusaheb, et al.
Publicado: (2025)
Efficient learning-based sound propagation for virtual and real-world audio processing applications
por: Ratnarajah, Anton Jeran
Publicado: (2024)
por: Ratnarajah, Anton Jeran
Publicado: (2024)
Towards predicting binaural audio quality in listeners with normal and impaired hearing
por: Biberger, Thomas, et al.
Publicado: (2025)
por: Biberger, Thomas, et al.
Publicado: (2025)
Unmasking real-world audio deepfakes: A data-centric approach
por: Combei, David, et al.
Publicado: (2025)
por: Combei, David, et al.
Publicado: (2025)
MBCodec:Thorough disentangle for high-fidelity audio compression
por: Zhang, Ruonan, et al.
Publicado: (2025)
por: Zhang, Ruonan, et al.
Publicado: (2025)
Real-time implementation of vibrato transfer as an audio effect
por: Hyrkas, Jeremy
Publicado: (2025)
por: Hyrkas, Jeremy
Publicado: (2025)
Tweaking autoregressive methods for inpainting of gaps in audio signals
por: Mokrý, Ondřej, et al.
Publicado: (2024)
por: Mokrý, Ondřej, et al.
Publicado: (2024)
ParaCLAP -- Towards a general language-audio model for computational paralinguistic tasks
por: Jing, Xin, et al.
Publicado: (2024)
por: Jing, Xin, et al.
Publicado: (2024)
AEROMamba: An efficient architecture for audio super-resolution using generative adversarial networks and state space models
por: Abreu, Wallace, et al.
Publicado: (2024)
por: Abreu, Wallace, et al.
Publicado: (2024)
Mellow: a small audio language model for reasoning
por: Deshmukh, Soham, et al.
Publicado: (2025)
por: Deshmukh, Soham, et al.
Publicado: (2025)
Reconstructing the Charlie Parker Omnibook using an audio-to-score automatic transcription pipeline
por: Riley, Xavier, et al.
Publicado: (2024)
por: Riley, Xavier, et al.
Publicado: (2024)
Ejemplares similares
-
Online Domain-Incremental Learning Approach to Classify Acoustic Scenes in All Locations
por: Mulimani, Manjunath, et al.
Publicado: (2024) -
Domain-Incremental Learning for Audio Classification
por: Mulimani, Manjunath, et al.
Publicado: (2024) -
Class-Incremental Learning for Multi-Label Audio Classification
por: Mulimani, Manjunath, et al.
Publicado: (2024) -
Sound event detection with audio-text models and heterogeneous temporal annotations
por: Harju, Manu, et al.
Publicado: (2025) -
Incremental learning for audio classification with Hebbian Deep Neural Networks
por: Casciotti, Riccardo, et al.
Publicado: (2026)