Combolutional Neural Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Churchwell, Cameron, Kim, Minje, Smaragdis, Paris |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adaptive Slimming for Scalable and Efficient Speech Enhancement
di: Miccini, Riccardo, et al.
Pubblicazione: (2025)
di: Miccini, Riccardo, et al.
Pubblicazione: (2025)
Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders
di: Bralios, Dimitrios, et al.
Pubblicazione: (2025)
di: Bralios, Dimitrios, et al.
Pubblicazione: (2025)
User-guided Generative Source Separation
di: Wen, Yutong, et al.
Pubblicazione: (2025)
di: Wen, Yutong, et al.
Pubblicazione: (2025)
Rethinking Non-Negative Matrix Factorization with Implicit Neural Representations
di: Subramani, Krishna, et al.
Pubblicazione: (2024)
di: Subramani, Krishna, et al.
Pubblicazione: (2024)
Learning to Upsample and Upmix Audio in the Latent Domain
di: Bralios, Dimitrios, et al.
Pubblicazione: (2025)
di: Bralios, Dimitrios, et al.
Pubblicazione: (2025)
On Class Separability Pitfalls In Audio-Text Contrastive Zero-Shot Learning
di: Tavares, Tiago, et al.
Pubblicazione: (2024)
di: Tavares, Tiago, et al.
Pubblicazione: (2024)
Sound Source Separation Using Latent Variational Block-Wise Disentanglement
di: Helwani, Karim, et al.
Pubblicazione: (2024)
di: Helwani, Karim, et al.
Pubblicazione: (2024)
Gencho: Room Impulse Response Generation from Reverberant Speech and Text via Diffusion Transformers
di: Lin, Jackie, et al.
Pubblicazione: (2026)
di: Lin, Jackie, et al.
Pubblicazione: (2026)
High-Fidelity Neural Phonetic Posteriorgrams
di: Churchwell, Cameron, et al.
Pubblicazione: (2024)
di: Churchwell, Cameron, et al.
Pubblicazione: (2024)
Audio Editing with Non-Rigid Text Prompts
di: Paissan, Francesco, et al.
Pubblicazione: (2023)
di: Paissan, Francesco, et al.
Pubblicazione: (2023)
Fine-Grained and Interpretable Neural Speech Editing
di: Morrison, Max, et al.
Pubblicazione: (2024)
di: Morrison, Max, et al.
Pubblicazione: (2024)
Scaling Up Adaptive Filter Optimizers
di: Casebeer, Jonah, et al.
Pubblicazione: (2024)
di: Casebeer, Jonah, et al.
Pubblicazione: (2024)
Noise-Robust DSP-Assisted Neural Pitch Estimation with Very Low Complexity
di: Subramani, Krishna, et al.
Pubblicazione: (2023)
di: Subramani, Krishna, et al.
Pubblicazione: (2023)
PromptSep: Generative Audio Separation via Multimodal Prompting
di: Wen, Yutong, et al.
Pubblicazione: (2025)
di: Wen, Yutong, et al.
Pubblicazione: (2025)
Generative Data Augmentation Challenge: Synthesis of Room Acoustics for Speaker Distance Estimation
di: Lin, Jackie, et al.
Pubblicazione: (2025)
di: Lin, Jackie, et al.
Pubblicazione: (2025)
A Comparative Analysis of Poetry Reading Audio: Singing, Narrating, or Somewhere In Between?
di: Choi, Kahyun, et al.
Pubblicazione: (2024)
di: Choi, Kahyun, et al.
Pubblicazione: (2024)
Hyperbolic Distance-Based Speech Separation
di: Petermann, Darius, et al.
Pubblicazione: (2024)
di: Petermann, Darius, et al.
Pubblicazione: (2024)
Personalized Neural Speech Codec
di: Jang, Inseon, et al.
Pubblicazione: (2024)
di: Jang, Inseon, et al.
Pubblicazione: (2024)
Bayesian Learning for Deep Neural Network Adaptation
di: Xie, Xurong, et al.
Pubblicazione: (2020)
di: Xie, Xurong, et al.
Pubblicazione: (2020)
Music Emotion Prediction Using Recurrent Neural Networks
di: Chang, Xinyu, et al.
Pubblicazione: (2024)
di: Chang, Xinyu, et al.
Pubblicazione: (2024)
Quantifying Quanvolutional Neural Networks Robustness for Speech in Healthcare Applications
di: Tran, Ha, et al.
Pubblicazione: (2026)
di: Tran, Ha, et al.
Pubblicazione: (2026)
Feature Aggregation in Joint Sound Classification and Localization Neural Networks
di: Healy, Brendan, et al.
Pubblicazione: (2023)
di: Healy, Brendan, et al.
Pubblicazione: (2023)
Audio Classification of Low Feature Spectrograms Utilizing Convolutional Neural Networks
di: Elias, Noel
Pubblicazione: (2024)
di: Elias, Noel
Pubblicazione: (2024)
Automatic Equalization for Individual Instrument Tracks Using Convolutional Neural Networks
di: Mockenhaupt, Florian, et al.
Pubblicazione: (2024)
di: Mockenhaupt, Florian, et al.
Pubblicazione: (2024)
Dynamic Gated Recurrent Neural Network for Compute-efficient Speech Enhancement
di: Cheng, Longbiao, et al.
Pubblicazione: (2024)
di: Cheng, Longbiao, et al.
Pubblicazione: (2024)
Barwise Section Boundary Detection in Symbolic Music Using Convolutional Neural Networks
di: Eldeeb, Omar, et al.
Pubblicazione: (2025)
di: Eldeeb, Omar, et al.
Pubblicazione: (2025)
InterGridNet: An Electric Network Frequency Approach for Audio Source Location Classification Using Convolutional Neural Networks
di: Korgialas, Christos, et al.
Pubblicazione: (2025)
di: Korgialas, Christos, et al.
Pubblicazione: (2025)
BigVSAN: Enhancing GAN-based Neural Vocoders with Slicing Adversarial Network
di: Shibuya, Takashi, et al.
Pubblicazione: (2023)
di: Shibuya, Takashi, et al.
Pubblicazione: (2023)
Vocal Melody Construction for Persian Lyrics Using LSTM Recurrent Neural Networks
di: Jafari, Farshad, et al.
Pubblicazione: (2024)
di: Jafari, Farshad, et al.
Pubblicazione: (2024)
Multi-stream Convolutional Neural Network with Frequency Selection for Robust Speaker Verification
di: Yao, Wei, et al.
Pubblicazione: (2020)
di: Yao, Wei, et al.
Pubblicazione: (2020)
Convolutional Neural Network Achieves Human-level Accuracy in Music Genre Classification
di: Dong, Mingwen
Pubblicazione: (2018)
di: Dong, Mingwen
Pubblicazione: (2018)
Investigation of Time-Frequency Feature Combinations with Histogram Layer Time Delay Neural Networks
di: Mohammadi, Amirmohammad, et al.
Pubblicazione: (2024)
di: Mohammadi, Amirmohammad, et al.
Pubblicazione: (2024)
Sentiment analysis in non-fixed length audios using a Fully Convolutional Neural Network
di: García-Ordás, María Teresa, et al.
Pubblicazione: (2024)
di: García-Ordás, María Teresa, et al.
Pubblicazione: (2024)
Over-the-air White-box Attack on the Wav2Vec Speech Recognition Neural Network
di: Alexey, Protopopov
Pubblicazione: (2026)
di: Alexey, Protopopov
Pubblicazione: (2026)
Detection of Electric Motor Damage Through Analysis of Sound Signals Using Bayesian Neural Networks
di: Bauer, Waldemar, et al.
Pubblicazione: (2024)
di: Bauer, Waldemar, et al.
Pubblicazione: (2024)
Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs
di: Kim, Minje, et al.
Pubblicazione: (2024)
di: Kim, Minje, et al.
Pubblicazione: (2024)
AbsoluteNet: A Deep Learning Neural Network to Classify Cerebral Hemodynamic Responses of Auditory Processing
di: Adeli, Behtom, et al.
Pubblicazione: (2025)
di: Adeli, Behtom, et al.
Pubblicazione: (2025)
Classification of Short Segment Pediatric Heart Sounds Based on a Transformer-Based Convolutional Neural Network
di: Hassanuzzaman, Md, et al.
Pubblicazione: (2024)
di: Hassanuzzaman, Md, et al.
Pubblicazione: (2024)
emoDARTS: Joint Optimisation of CNN & Sequential Neural Network Architectures for Superior Speech Emotion Recognition
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2024)
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2024)
Reverse-Speech-Finder: A Neural Network Backtracking Architecture for Generating Alzheimer's Disease Speech Samples and Improving Diagnosis Performance
di: Li, Victor OK, et al.
Pubblicazione: (2025)
di: Li, Victor OK, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Adaptive Slimming for Scalable and Efficient Speech Enhancement
di: Miccini, Riccardo, et al.
Pubblicazione: (2025) -
Re-Bottleneck: Latent Re-Structuring for Neural Audio Autoencoders
di: Bralios, Dimitrios, et al.
Pubblicazione: (2025) -
User-guided Generative Source Separation
di: Wen, Yutong, et al.
Pubblicazione: (2025) -
Rethinking Non-Negative Matrix Factorization with Implicit Neural Representations
di: Subramani, Krishna, et al.
Pubblicazione: (2024) -
Learning to Upsample and Upmix Audio in the Latent Domain
di: Bralios, Dimitrios, et al.
Pubblicazione: (2025)