Enregistré dans:
| Auteurs principaux: | Diaz, Rodrigo, Sandler, Mark |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2505.05940 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Efficient Modelling of String Dynamics: A Comparison of State Space and Koopman based Deep Learning Methods
par: Diaz, Rodrigo, et autres
Publié: (2024)
par: Diaz, Rodrigo, et autres
Publié: (2024)
nlm: Real-Time Non-linear Modal Synthesis in Max
par: Diaz, Rodrigo, et autres
Publié: (2026)
par: Diaz, Rodrigo, et autres
Publié: (2026)
Evaluation of Neural Surrogates for Physical Modelling Synthesis of Nonlinear Elastic Plates
par: Martin, Carlos De La Vega, et autres
Publié: (2025)
par: Martin, Carlos De La Vega, et autres
Publié: (2025)
Stable Differentiable Modal Synthesis for Learning Nonlinear Dynamics
par: Zheleznov, Victor, et autres
Publié: (2026)
par: Zheleznov, Victor, et autres
Publié: (2026)
Learning Nonlinear Dynamics in Physical Modelling Synthesis using Neural Ordinary Differential Equations
par: Zheleznov, Victor, et autres
Publié: (2025)
par: Zheleznov, Victor, et autres
Publié: (2025)
A Conditioned UNet for Music Source Separation
par: O'Hanlon, Ken, et autres
Publié: (2025)
par: O'Hanlon, Ken, et autres
Publié: (2025)
Designing Neural Synthesizers for Low-Latency Interaction
par: Caspe, Franco, et autres
Publié: (2025)
par: Caspe, Franco, et autres
Publié: (2025)
Symbolic Music Generation with Non-Differentiable Rule Guided Diffusion
par: Huang, Yujia, et autres
Publié: (2024)
par: Huang, Yujia, et autres
Publié: (2024)
Multi-channel Speech Separation Using Spatially Selective Deep Non-linear Filters
par: Tesch, Kristina, et autres
Publié: (2023)
par: Tesch, Kristina, et autres
Publié: (2023)
Physics and geometry informed neural operator network with application to acoustic scattering
par: Nair, Siddharth, et autres
Publié: (2024)
par: Nair, Siddharth, et autres
Publié: (2024)
Cascaded Cross-Modal Transformer for Audio-Textual Classification
par: Ristea, Nicolae-Catalin, et autres
Publié: (2024)
par: Ristea, Nicolae-Catalin, et autres
Publié: (2024)
Sparse Binarization for Fast Keyword Spotting
par: Svirsky, Jonathan, et autres
Publié: (2024)
par: Svirsky, Jonathan, et autres
Publié: (2024)
Multi-Microphone and Multi-Modal Emotion Recognition in Reverberant Environment
par: Cohen, Ohad, et autres
Publié: (2024)
par: Cohen, Ohad, et autres
Publié: (2024)
Fast Timing-Conditioned Latent Audio Diffusion
par: Evans, Zach, et autres
Publié: (2024)
par: Evans, Zach, et autres
Publié: (2024)
Towards Robust FastSpeech 2 by Modelling Residual Multimodality
par: Kögel, Fabian, et autres
Publié: (2023)
par: Kögel, Fabian, et autres
Publié: (2023)
Modulation Discovery with Differentiable Digital Signal Processing
par: Mitcheltree, Christopher, et autres
Publié: (2025)
par: Mitcheltree, Christopher, et autres
Publié: (2025)
Fast and Flexible Audio Bandwidth Extension via Vocos
par: Sharma, Yatharth
Publié: (2026)
par: Sharma, Yatharth
Publié: (2026)
Differentiable Modal Synthesis for Physical Modeling of Planar String Sound and Motion Simulation
par: Lee, Jin Woo, et autres
Publié: (2024)
par: Lee, Jin Woo, et autres
Publié: (2024)
Differentiable All-pole Filters for Time-varying Audio Systems
par: Yu, Chin-Yun, et autres
Publié: (2024)
par: Yu, Chin-Yun, et autres
Publié: (2024)
Enhancing Speech Emotion Recognition Through Differentiable Architecture Search
par: Rajapakshe, Thejan, et autres
Publié: (2023)
par: Rajapakshe, Thejan, et autres
Publié: (2023)
SimulTron: On-Device Simultaneous Speech to Speech Translation
par: Agranovich, Alex, et autres
Publié: (2024)
par: Agranovich, Alex, et autres
Publié: (2024)
Decodable but not structured: linear probing enables Underwater Acoustic Target Recognition with pretrained audio embeddings
par: Hummel, Hilde I., et autres
Publié: (2026)
par: Hummel, Hilde I., et autres
Publié: (2026)
Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper
par: Syed, Jaza, et autres
Publié: (2025)
par: Syed, Jaza, et autres
Publié: (2025)
A Differentiable Alignment Framework for Sequence-to-Sequence Modeling via Optimal Transport
par: Kaloga, Yacouba, et autres
Publié: (2025)
par: Kaloga, Yacouba, et autres
Publié: (2025)
Ultra-lightweight Neural Differential DSP Vocoder For High Quality Speech Synthesis
par: Agrawal, Prabhav, et autres
Publié: (2024)
par: Agrawal, Prabhav, et autres
Publié: (2024)
Audio Simulation for Sound Source Localization in Virtual Evironment
par: Di Yuan, Yi, et autres
Publié: (2024)
par: Di Yuan, Yi, et autres
Publié: (2024)
Towards the Synthesis of Non-speech Vocalizations
par: Hoq, Enjamamul, et autres
Publié: (2024)
par: Hoq, Enjamamul, et autres
Publié: (2024)
MiSTR: Multi-Modal iEEG-to-Speech Synthesis with Transformer-Based Prosody Prediction and Neural Phase Reconstruction
par: Al-Radhi, Mohammed Salah, et autres
Publié: (2025)
par: Al-Radhi, Mohammed Salah, et autres
Publié: (2025)
Computational music analysis from first principles
par: Tymoczko, Dmitri, et autres
Publié: (2024)
par: Tymoczko, Dmitri, et autres
Publié: (2024)
Audio Editing with Non-Rigid Text Prompts
par: Paissan, Francesco, et autres
Publié: (2023)
par: Paissan, Francesco, et autres
Publié: (2023)
An Attention Long Short-Term Memory based system for automatic classification of speech intelligibility
par: Fernández-Díaz, Miguel, et autres
Publié: (2024)
par: Fernández-Díaz, Miguel, et autres
Publié: (2024)
Revisit Modality Imbalance at the Decision Layer
par: Ma, Xiaoyu, et autres
Publié: (2025)
par: Ma, Xiaoyu, et autres
Publié: (2025)
Modulating State Space Model with SlowFast Framework for Compute-Efficient Ultra Low-Latency Speech Enhancement
par: Cheng, Longbiao, et autres
Publié: (2024)
par: Cheng, Longbiao, et autres
Publié: (2024)
Data-Driven Room Acoustic Modeling Via Differentiable Feedback Delay Networks With Learnable Delay Lines
par: Mezza, Alessandro Ilic, et autres
Publié: (2024)
par: Mezza, Alessandro Ilic, et autres
Publié: (2024)
Contextual Speech Extraction: Leveraging Textual History as an Implicit Cue for Target Speech Extraction
par: Kim, Minsu, et autres
Publié: (2025)
par: Kim, Minsu, et autres
Publié: (2025)
Non-verbal information in spontaneous speech -- towards a new framework of analysis
par: Biron, Tirza, et autres
Publié: (2024)
par: Biron, Tirza, et autres
Publié: (2024)
Rethinking Non-Negative Matrix Factorization with Implicit Neural Representations
par: Subramani, Krishna, et autres
Publié: (2024)
par: Subramani, Krishna, et autres
Publié: (2024)
Biomimetic Frontend for Differentiable Audio Processing
par: Famularo, Ruolan Leslie, et autres
Publié: (2024)
par: Famularo, Ruolan Leslie, et autres
Publié: (2024)
LACTOSE: Linear Array of Conditions, TOpologies with Separated Error-backpropagation -- The Differentiable "IF" Conditional for Differentiable Digital Signal Processing
par: Clarke, Christopher Johann
Publié: (2025)
par: Clarke, Christopher Johann
Publié: (2025)
Scoring Time Intervals using Non-Hierarchical Transformer For Automatic Piano Transcription
par: Yan, Yujia, et autres
Publié: (2024)
par: Yan, Yujia, et autres
Publié: (2024)
Documents similaires
-
Towards Efficient Modelling of String Dynamics: A Comparison of State Space and Koopman based Deep Learning Methods
par: Diaz, Rodrigo, et autres
Publié: (2024) -
nlm: Real-Time Non-linear Modal Synthesis in Max
par: Diaz, Rodrigo, et autres
Publié: (2026) -
Evaluation of Neural Surrogates for Physical Modelling Synthesis of Nonlinear Elastic Plates
par: Martin, Carlos De La Vega, et autres
Publié: (2025) -
Stable Differentiable Modal Synthesis for Learning Nonlinear Dynamics
par: Zheleznov, Victor, et autres
Publié: (2026) -
Learning Nonlinear Dynamics in Physical Modelling Synthesis using Neural Ordinary Differential Equations
par: Zheleznov, Victor, et autres
Publié: (2025)