Modeling Time-Variant Responses of Optical Compressors with Selective State Space Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Simionato, Riccardo, Fasciani, Stefano |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Sines, Transient, Noise Neural Modeling of Piano Notes
di: Simionato, Riccardo, et al.
Pubblicazione: (2024)
di: Simionato, Riccardo, et al.
Pubblicazione: (2024)
SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation
di: Mu, Da, et al.
Pubblicazione: (2024)
di: Mu, Da, et al.
Pubblicazione: (2024)
Exploring State-Space-Model based Language Model in Music Generation
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025)
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025)
Audio Mamba: Selective State Spaces for Self-Supervised Audio Representations
di: Yadav, Sarthak, et al.
Pubblicazione: (2024)
di: Yadav, Sarthak, et al.
Pubblicazione: (2024)
Audio Mamba: Bidirectional State Space Model for Audio Representation Learning
di: Erol, Mehmet Hamza, et al.
Pubblicazione: (2024)
di: Erol, Mehmet Hamza, et al.
Pubblicazione: (2024)
Audio Mamba: Pretrained Audio State Space Model For Audio Tagging
di: Lin, Jiaju, et al.
Pubblicazione: (2024)
di: Lin, Jiaju, et al.
Pubblicazione: (2024)
SHMamba: Structured Hyperbolic State Space Model for Audio-Visual Question Answering
di: Yang, Zhe, et al.
Pubblicazione: (2024)
di: Yang, Zhe, et al.
Pubblicazione: (2024)
DiffusionRIR: Room Impulse Response Interpolation using Diffusion Models
di: Della Torre, Sagi, et al.
Pubblicazione: (2025)
di: Della Torre, Sagi, et al.
Pubblicazione: (2025)
Estimating Musical Surprisal from Audio in Autoregressive Diffusion Model Noise Spaces
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2025)
Time-Frequency-Based Attention Cache Memory Model for Real-Time Speech Separation
di: Chen, Guo, et al.
Pubblicazione: (2025)
di: Chen, Guo, et al.
Pubblicazione: (2025)
Comparative Study of State-based Neural Networks for Virtual Analog Audio Effects Modeling
di: Simionato, Riccardo, et al.
Pubblicazione: (2024)
di: Simionato, Riccardo, et al.
Pubblicazione: (2024)
ES4R: Speech Encoding Based on Prepositive Affective Modeling for Empathetic Response Generation
di: Gao, Zhuoyue, et al.
Pubblicazione: (2026)
di: Gao, Zhuoyue, et al.
Pubblicazione: (2026)
Notochord: a Flexible Probabilistic Model for Real-Time MIDI Performance
di: Shepardson, Victor, et al.
Pubblicazione: (2024)
di: Shepardson, Victor, et al.
Pubblicazione: (2024)
Decoding Ambiguous Emotions with Test-Time Scaling in Audio-Language Models
di: Jia, Hong, et al.
Pubblicazione: (2026)
di: Jia, Hong, et al.
Pubblicazione: (2026)
Diffused Responsibility: Analyzing the Energy Consumption of Generative Text-to-Audio Diffusion Models
di: Passoni, Riccardo, et al.
Pubblicazione: (2025)
di: Passoni, Riccardo, et al.
Pubblicazione: (2025)
Scaling Auditory Cognition via Test-Time Compute in Audio Language Models
di: Dang, Ting, et al.
Pubblicazione: (2025)
di: Dang, Ting, et al.
Pubblicazione: (2025)
A Lightweight and Real-Time Binaural Speech Enhancement Model with Spatial Cues Preservation
di: Wang, Jingyuan, et al.
Pubblicazione: (2024)
di: Wang, Jingyuan, et al.
Pubblicazione: (2024)
Selective Attention System (SAS): Device-Addressed Speech Detection for Real-Time On-Device Voice AI
di: Kim, David Joohun, et al.
Pubblicazione: (2026)
di: Kim, David Joohun, et al.
Pubblicazione: (2026)
Samba-ASR: State-Of-The-Art Speech Recognition Leveraging Structured State-Space Models
di: Shakhadri, Syed Abdul Gaffar, et al.
Pubblicazione: (2025)
di: Shakhadri, Syed Abdul Gaffar, et al.
Pubblicazione: (2025)
Music Consistency Models
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
SCRAPS: Speech Contrastive Representations of Acoustic and Phonetic Spaces
di: Vallés-Pérez, Ivan, et al.
Pubblicazione: (2023)
di: Vallés-Pérez, Ivan, et al.
Pubblicazione: (2023)
Parameter Selection for Analyzing Conversations with Autism Spectrum Disorder
di: Chowdhury, Tahiya, et al.
Pubblicazione: (2024)
di: Chowdhury, Tahiya, et al.
Pubblicazione: (2024)
Deep Space Separable Distillation for Lightweight Acoustic Scene Classification
di: Ye, ShuQi, et al.
Pubblicazione: (2024)
di: Ye, ShuQi, et al.
Pubblicazione: (2024)
Selective Classifier-free Guidance for Zero-shot Text-to-speech
di: Zheng, John, et al.
Pubblicazione: (2025)
di: Zheng, John, et al.
Pubblicazione: (2025)
Diff-V2M: A Hierarchical Conditional Diffusion Model with Explicit Rhythmic Modeling for Video-to-Music Generation
di: Ji, Shulei, et al.
Pubblicazione: (2025)
di: Ji, Shulei, et al.
Pubblicazione: (2025)
The Interpretation Gap in Text-to-Music Generation Models
di: Zang, Yongyi, et al.
Pubblicazione: (2024)
di: Zang, Yongyi, et al.
Pubblicazione: (2024)
Certification of Speaker Recognition Models to Additive Perturbations
di: Korzh, Dmitrii, et al.
Pubblicazione: (2024)
di: Korzh, Dmitrii, et al.
Pubblicazione: (2024)
Audio Explanation Synthesis with Generative Foundation Models
di: Akman, Alican, et al.
Pubblicazione: (2024)
di: Akman, Alican, et al.
Pubblicazione: (2024)
Abstract Sound Fusion with Unconditional Inversion Models
di: Liu, Jing, et al.
Pubblicazione: (2025)
di: Liu, Jing, et al.
Pubblicazione: (2025)
Adaptive Duration Model for Text Speech Alignment
di: Cao, Junjie
Pubblicazione: (2025)
di: Cao, Junjie
Pubblicazione: (2025)
MambaFoley: Foley Sound Generation using Selective State-Space Models
di: Colombo, Marco Furio, et al.
Pubblicazione: (2024)
di: Colombo, Marco Furio, et al.
Pubblicazione: (2024)
Cross-attention Inspired Selective State Space Models for Target Sound Extraction
di: Wu, Donghang, et al.
Pubblicazione: (2024)
di: Wu, Donghang, et al.
Pubblicazione: (2024)
Speech-Mamba: Long-Context Speech Recognition with Selective State Spaces Models
di: Gao, Xiaoxue, et al.
Pubblicazione: (2024)
di: Gao, Xiaoxue, et al.
Pubblicazione: (2024)
ASoBO: Attentive Beamformer Selection for Distant Speaker Diarization in Meetings
di: Mariotte, Theo, et al.
Pubblicazione: (2024)
di: Mariotte, Theo, et al.
Pubblicazione: (2024)
TISDiSS: A Training-Time and Inference-Time Scalable Framework for Discriminative Source Separation
di: Feng, Yongsheng, et al.
Pubblicazione: (2025)
di: Feng, Yongsheng, et al.
Pubblicazione: (2025)
Differentiable Time-Varying IIR Filtering for Real-Time Speech Denoising
di: Rota, Riccardo, et al.
Pubblicazione: (2026)
di: Rota, Riccardo, et al.
Pubblicazione: (2026)
AND: Audio Network Dissection for Interpreting Deep Acoustic Models
di: Wu, Tung-Yu, et al.
Pubblicazione: (2024)
di: Wu, Tung-Yu, et al.
Pubblicazione: (2024)
ASD-Diffusion: Anomalous Sound Detection with Diffusion Models
di: Zhang, Fengrun, et al.
Pubblicazione: (2024)
di: Zhang, Fengrun, et al.
Pubblicazione: (2024)
FoleyBench: A Benchmark For Video-to-Audio Models
di: Dixit, Satvik, et al.
Pubblicazione: (2025)
di: Dixit, Satvik, et al.
Pubblicazione: (2025)
Content-based Controls For Music Large Language Modeling
di: Lin, Liwei, et al.
Pubblicazione: (2023)
di: Lin, Liwei, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Sines, Transient, Noise Neural Modeling of Piano Notes
di: Simionato, Riccardo, et al.
Pubblicazione: (2024) -
SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation
di: Mu, Da, et al.
Pubblicazione: (2024) -
Exploring State-Space-Model based Language Model in Music Generation
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025) -
Audio Mamba: Selective State Spaces for Self-Supervised Audio Representations
di: Yadav, Sarthak, et al.
Pubblicazione: (2024) -
Audio Mamba: Bidirectional State Space Model for Audio Representation Learning
di: Erol, Mehmet Hamza, et al.
Pubblicazione: (2024)