Towards Efficient Modelling of String Dynamics: A Comparison of State Space and Koopman based Deep Learning Methods
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Diaz, Rodrigo, Martin, Carlos De La Vega, Sandler, Mark |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluation of Neural Surrogates for Physical Modelling Synthesis of Nonlinear Elastic Plates
par: Martin, Carlos De La Vega, et autres
Publié: (2025)
par: Martin, Carlos De La Vega, et autres
Publié: (2025)
nlm: Real-Time Non-linear Modal Synthesis in Max
par: Diaz, Rodrigo, et autres
Publié: (2026)
par: Diaz, Rodrigo, et autres
Publié: (2026)
Fast Differentiable Modal Simulation of Non-linear Strings, Membranes, and Plates
par: Diaz, Rodrigo, et autres
Publié: (2025)
par: Diaz, Rodrigo, et autres
Publié: (2025)
Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper
par: Syed, Jaza, et autres
Publié: (2025)
par: Syed, Jaza, et autres
Publié: (2025)
State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition
par: Farhadipour, Aref, et autres
Publié: (2025)
par: Farhadipour, Aref, et autres
Publié: (2025)
Temporal-Frequency State Space Duality: An Efficient Paradigm for Speech Emotion Recognition
par: Zhao, Jiaqi, et autres
Publié: (2024)
par: Zhao, Jiaqi, et autres
Publié: (2024)
Interpreting the Dimensions of Speaker Embedding Space
par: Huckvale, Mark
Publié: (2025)
par: Huckvale, Mark
Publié: (2025)
GuitarFlow: Realistic Electric Guitar Synthesis From Tablatures via Flow Matching and Style Transfer
par: Loth, Jackson, et autres
Publié: (2025)
par: Loth, Jackson, et autres
Publié: (2025)
Efficient Area-based and Speaker-Agnostic Source Separation
par: Strauss, Martin, et autres
Publié: (2024)
par: Strauss, Martin, et autres
Publié: (2024)
A Novel Deep Learning Framework for Efficient Multichannel Acoustic Feedback Control
par: Wu, Yuan-Kuei, et autres
Publié: (2025)
par: Wu, Yuan-Kuei, et autres
Publié: (2025)
Comparison of Self-Supervised Speech Pre-Training Methods on Flemish Dutch
par: Poncelet, Jakob, et autres
Publié: (2021)
par: Poncelet, Jakob, et autres
Publié: (2021)
Automatic Estimation of Singing Voice Musical Dynamics
par: Narang, Jyoti, et autres
Publié: (2024)
par: Narang, Jyoti, et autres
Publié: (2024)
Predicting Global HRTFs From Scanned Head Geometry Using Deep Learning and Compact Representations
par: Wang, Yuxiang, et autres
Publié: (2022)
par: Wang, Yuxiang, et autres
Publié: (2022)
Comparative Analysis Of Discriminative Deep Learning-Based Noise Reduction Methods In Low SNR Scenarios
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
par: Shetu, Shrishti Saha, et autres
Publié: (2024)
Noise-to-mask Ratio Loss for Deep Neural Network based Audio Watermarking
par: Moritz, Martin, et autres
Publié: (2024)
par: Moritz, Martin, et autres
Publié: (2024)
CTC Blank Triggered Dynamic Layer-Skipping for Efficient CTC-based Speech Recognition
par: Hou, Junfeng, et autres
Publié: (2024)
par: Hou, Junfeng, et autres
Publié: (2024)
Keyword Mamba: Spoken Keyword Spotting with State Space Models
par: Ding, Hanyu, et autres
Publié: (2025)
par: Ding, Hanyu, et autres
Publié: (2025)
Synthetic Singers: A Review of Deep-Learning-based Singing Voice Synthesis Approaches
par: Pan, Changhao, et autres
Publié: (2026)
par: Pan, Changhao, et autres
Publié: (2026)
SAM: A Mamba-2 State-Space Audio-Language Model
par: Lee, Taehan, et autres
Publié: (2025)
par: Lee, Taehan, et autres
Publié: (2025)
Improving Speech Enhancement by Cross- and Sub-band Processing with State Space Model
par: Li, Jizhen, et autres
Publié: (2025)
par: Li, Jizhen, et autres
Publié: (2025)
MambaFoley: Foley Sound Generation using Selective State-Space Models
par: Colombo, Marco Furio, et autres
Publié: (2024)
par: Colombo, Marco Furio, et autres
Publié: (2024)
Cross-attention Inspired Selective State Space Models for Target Sound Extraction
par: Wu, Donghang, et autres
Publié: (2024)
par: Wu, Donghang, et autres
Publié: (2024)
Speech-Mamba: Long-Context Speech Recognition with Selective State Spaces Models
par: Gao, Xiaoxue, et autres
Publié: (2024)
par: Gao, Xiaoxue, et autres
Publié: (2024)
Frequency Tracking Features for Data-Efficient Deep Siren Identification
par: Damiano, Stefano, et autres
Publié: (2024)
par: Damiano, Stefano, et autres
Publié: (2024)
Multi-Speaker DOA Estimation in Binaural Hearing Aids using Deep Learning and Speaker Count Fusion
par: Jazaeri, Farnaz, et autres
Publié: (2025)
par: Jazaeri, Farnaz, et autres
Publié: (2025)
SICRN: Advancing Speech Enhancement through State Space Model and Inplace Convolution Techniques
par: Zhao, Changjiang, et autres
Publié: (2024)
par: Zhao, Changjiang, et autres
Publié: (2024)
RawBMamba: End-to-End Bidirectional State Space Model for Audio Deepfake Detection
par: Chen, Yujie, et autres
Publié: (2024)
par: Chen, Yujie, et autres
Publié: (2024)
Compositional Audio Representation Learning
par: Sridhar, Sripathi, et autres
Publié: (2024)
par: Sridhar, Sripathi, et autres
Publié: (2024)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
par: Ratnarajah, Anton, et autres
Publié: (2023)
par: Ratnarajah, Anton, et autres
Publié: (2023)
XLSR-Mamba: A Dual-Column Bidirectional State Space Model for Spoofing Attack Detection
par: Xiao, Yang, et autres
Publié: (2024)
par: Xiao, Yang, et autres
Publié: (2024)
Efficient Scaling for LLM-based ASR
par: Mu, Bingshen, et autres
Publié: (2025)
par: Mu, Bingshen, et autres
Publié: (2025)
GOAT: A Large Dataset of Paired Guitar Audio Recordings and Tablatures
par: Loth, Jackson, et autres
Publié: (2025)
par: Loth, Jackson, et autres
Publié: (2025)
Deep Learning for Personalized Binaural Audio Reproduction
par: Lu, Xikun, et autres
Publié: (2025)
par: Lu, Xikun, et autres
Publié: (2025)
Towards Bitrate-Efficient and Noise-Robust Speech Coding with Variable Bitrate RVQ
par: Chae, Yunkee, et autres
Publié: (2025)
par: Chae, Yunkee, et autres
Publié: (2025)
Towards Decoupling Frontend Enhancement and Backend Recognition in Monaural Robust ASR
par: Yang, Yufeng, et autres
Publié: (2024)
par: Yang, Yufeng, et autres
Publié: (2024)
Efficient Audio Captioning with Encoder-Level Knowledge Distillation
par: Xu, Xuenan, et autres
Publié: (2024)
par: Xu, Xuenan, et autres
Publié: (2024)
Dual-path Mamba: Short and Long-term Bidirectional Selective Structured State Space Models for Speech Separation
par: Jiang, Xilin, et autres
Publié: (2024)
par: Jiang, Xilin, et autres
Publié: (2024)
BSDB-Net: Band-Split Dual-Branch Network with Selective State Spaces Mechanism for Monaural Speech Enhancement
par: Fan, Cunhang, et autres
Publié: (2024)
par: Fan, Cunhang, et autres
Publié: (2024)
LibriTTS-VI: A Public Corpus and Novel Methods for Efficient Voice Impression Control
par: Ohmura, Junki, et autres
Publié: (2025)
par: Ohmura, Junki, et autres
Publié: (2025)
Deep learning based spatial aliasing reduction in beamforming for audio capture
par: Guzik, Mateusz, et autres
Publié: (2025)
par: Guzik, Mateusz, et autres
Publié: (2025)
Documents similaires
-
Evaluation of Neural Surrogates for Physical Modelling Synthesis of Nonlinear Elastic Plates
par: Martin, Carlos De La Vega, et autres
Publié: (2025) -
nlm: Real-Time Non-linear Modal Synthesis in Max
par: Diaz, Rodrigo, et autres
Publié: (2026) -
Fast Differentiable Modal Simulation of Non-linear Strings, Membranes, and Plates
par: Diaz, Rodrigo, et autres
Publié: (2025) -
Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper
par: Syed, Jaza, et autres
Publié: (2025) -
State-Space Models in Efficient Whispered and Multi-dialect Speech Recognition
par: Farhadipour, Aref, et autres
Publié: (2025)