Large Language Models and Non-Negative Matrix Factorization for Bioacoustic Signal Decomposition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Torabi, Yasaman, Shirani, Shahram, Reilly, James P. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Large Language Model-based Nonnegative Matrix Factorization For Cardiorespiratory Sound Separation
par: Torabi, Yasaman, et autres
Publié: (2025)
par: Torabi, Yasaman, et autres
Publié: (2025)
Blind Source Separation in Biomedical Signals Using Variational Methods
par: Torabi, Yasaman, et autres
Publié: (2025)
par: Torabi, Yasaman, et autres
Publié: (2025)
AI-Driven Cardiorespiratory Signal Processing: Separation, Clustering, and Anomaly Detection
par: Torabi, Yasaman
Publié: (2026)
par: Torabi, Yasaman
Publié: (2026)
Manikin-Recorded Cardiopulmonary Sounds Dataset Using Digital Stethoscope
par: Torabi, Yasaman, et autres
Publié: (2024)
par: Torabi, Yasaman, et autres
Publié: (2024)
MEMS and ECM Sensor Technologies for Cardiorespiratory Sound Monitoring - A Comprehensive Review
par: Torabi, Yasaman, et autres
Publié: (2024)
par: Torabi, Yasaman, et autres
Publié: (2024)
Adaptive Learning via a Negative Selection Strategy for Few-Shot Bioacoustic Event Detection
par: Chen, Yaxiong, et autres
Publié: (2024)
par: Chen, Yaxiong, et autres
Publié: (2024)
BioME: A Resource-Efficient Bioacoustic Foundational Model for IoT Applications
par: Guimarães, Heitor R., et autres
Publié: (2026)
par: Guimarães, Heitor R., et autres
Publié: (2026)
Rethinking Non-Negative Matrix Factorization with Implicit Neural Representations
par: Subramani, Krishna, et autres
Publié: (2024)
par: Subramani, Krishna, et autres
Publié: (2024)
Robust Bioacoustic Detection via Richly Labelled Synthetic Soundscape Augmentation
par: Soltero, Kaspar, et autres
Publié: (2025)
par: Soltero, Kaspar, et autres
Publié: (2025)
Explainable by-design Audio Segmentation through Non-Negative Matrix Factorization and Probing
par: Lebourdais, Martin, et autres
Publié: (2024)
par: Lebourdais, Martin, et autres
Publié: (2024)
Towards High-Fidelity and Controllable Bioacoustic Generation via Enhanced Diffusion Learning
par: Song, Tianyu, et autres
Publié: (2025)
par: Song, Tianyu, et autres
Publié: (2025)
Distilling Spectrograms into Tokens: Fast and Lightweight Bioacoustic Classification for BirdCLEF+ 2025
par: Miyaguchi, Anthony, et autres
Publié: (2025)
par: Miyaguchi, Anthony, et autres
Publié: (2025)
Few-Shot Bioacoustic Event Detection with Frame-Level Embedding Learning System
par: Zhao, PengYuan, et autres
Publié: (2024)
par: Zhao, PengYuan, et autres
Publié: (2024)
Learning Domain-Robust Bioacoustic Representations for Mosquito Species Classification with Contrastive Learning and Distribution Alignment
par: Hou, Yuanbo, et autres
Publié: (2025)
par: Hou, Yuanbo, et autres
Publié: (2025)
Sequence-to-Sequence Multi-Modal Speech In-Painting
par: Elyaderani, Mahsa Kadkhodaei, et autres
Publié: (2024)
par: Elyaderani, Mahsa Kadkhodaei, et autres
Publié: (2024)
Robust Multi-Modal Speech In-Painting: A Sequence-to-Sequence Approach
par: Elyaderani, Mahsa Kadkhodaei, et autres
Publié: (2024)
par: Elyaderani, Mahsa Kadkhodaei, et autres
Publié: (2024)
BirdSet: A Large-Scale Dataset for Audio Classification in Avian Bioacoustics
par: Rauch, Lukas, et autres
Publié: (2024)
par: Rauch, Lukas, et autres
Publié: (2024)
Perch 2.0: The Bittern Lesson for Bioacoustics
par: van Merriënboer, Bart, et autres
Publié: (2025)
par: van Merriënboer, Bart, et autres
Publié: (2025)
Towards Deep Active Learning in Avian Bioacoustics
par: Rauch, Lukas, et autres
Publié: (2024)
par: Rauch, Lukas, et autres
Publié: (2024)
Audible Networks: Deconstructing and Manipulating Sounds with Deep Non-Negative Autoencoders
par: Burred, Juan José, et autres
Publié: (2025)
par: Burred, Juan José, et autres
Publié: (2025)
A Study on Zero-shot Non-intrusive Speech Assessment using Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2024)
par: Zezario, Ryandhimas E., et autres
Publié: (2024)
The Rhythm In Anything: Audio-Prompted Drums Generation with Masked Language Modeling
par: O'Reilly, Patrick, et autres
Publié: (2025)
par: O'Reilly, Patrick, et autres
Publié: (2025)
A Study on Zero-Shot Non-Intrusive Speech Intelligibility for Hearing Aids Using Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
par: Zezario, Ryandhimas E., et autres
Publié: (2025)
NatureLM-audio: an Audio-Language Foundation Model for Bioacoustics
par: Robinson, David, et autres
Publié: (2024)
par: Robinson, David, et autres
Publié: (2024)
SLAP: Siamese Language-Audio Pretraining Without Negative Samples for Music Understanding
par: Guinot, Julien, et autres
Publié: (2025)
par: Guinot, Julien, et autres
Publié: (2025)
Regularized Contrastive Pre-training for Few-shot Bioacoustic Sound Detection
par: Moummad, Ilyass, et autres
Publié: (2023)
par: Moummad, Ilyass, et autres
Publié: (2023)
Unlocking Large Audio-Language Models for Interactive Language Learning
par: Liu, Hongfu, et autres
Publié: (2026)
par: Liu, Hongfu, et autres
Publié: (2026)
From Human Speech to Ocean Signals: Transferring Speech Large Models for Underwater Acoustic Target Recognition
par: Huang, Mengcheng, et autres
Publié: (2026)
par: Huang, Mengcheng, et autres
Publié: (2026)
Aggregation Strategies for Efficient Annotation of Bioacoustic Sound Events Using Active Learning
par: Lindholm, Richard, et autres
Publié: (2025)
par: Lindholm, Richard, et autres
Publié: (2025)
Large Language Models: From Notes to Musical Form
par: Atassi, Lilac
Publié: (2024)
par: Atassi, Lilac
Publié: (2024)
Can Large Language Models Understand Spatial Audio?
par: Tang, Changli, et autres
Publié: (2024)
par: Tang, Changli, et autres
Publié: (2024)
Spatial Voice Conversion: Voice Conversion Preserving Spatial Information and Non-target Signals
par: Seki, Kentaro, et autres
Publié: (2024)
par: Seki, Kentaro, et autres
Publié: (2024)
Foundation Models for Bioacoustics -- a Comparative Review
par: Schwinger, Raphael, et autres
Publié: (2025)
par: Schwinger, Raphael, et autres
Publié: (2025)
Towards Building Speech Large Language Models for Multitask Understanding in Low-Resource Languages
par: Shao, Mingchen, et autres
Publié: (2025)
par: Shao, Mingchen, et autres
Publié: (2025)
DIFFA: Large Language Diffusion Models Can Listen and Understand
par: Zhou, Jiaming, et autres
Publié: (2025)
par: Zhou, Jiaming, et autres
Publié: (2025)
Can Audio Large Language Models Verify Speaker Identity?
par: Ren, Yiming, et autres
Publié: (2025)
par: Ren, Yiming, et autres
Publié: (2025)
SILA: Signal-to-Language Augmentation for Enhanced Control in Text-to-Audio Generation
par: Kumar, Sonal, et autres
Publié: (2024)
par: Kumar, Sonal, et autres
Publié: (2024)
FADI-AEC: Fast Score Based Diffusion Model Guided by Far-end Signal for Acoustic Echo Cancellation
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
Deep Audio Watermarks are Shallow: Limitations of Post-Hoc Watermarking Techniques for Speech
par: O'Reilly, Patrick, et autres
Publié: (2025)
par: O'Reilly, Patrick, et autres
Publié: (2025)
Enhancing Speech Large Language Models with Prompt-Aware Mixture of Audio Encoders
par: Shan, Weiqiao, et autres
Publié: (2025)
par: Shan, Weiqiao, et autres
Publié: (2025)
Documents similaires
-
Large Language Model-based Nonnegative Matrix Factorization For Cardiorespiratory Sound Separation
par: Torabi, Yasaman, et autres
Publié: (2025) -
Blind Source Separation in Biomedical Signals Using Variational Methods
par: Torabi, Yasaman, et autres
Publié: (2025) -
AI-Driven Cardiorespiratory Signal Processing: Separation, Clustering, and Anomaly Detection
par: Torabi, Yasaman
Publié: (2026) -
Manikin-Recorded Cardiopulmonary Sounds Dataset Using Digital Stethoscope
par: Torabi, Yasaman, et autres
Publié: (2024) -
MEMS and ECM Sensor Technologies for Cardiorespiratory Sound Monitoring - A Comprehensive Review
par: Torabi, Yasaman, et autres
Publié: (2024)