Investigation of Time-Frequency Feature Combinations with Histogram Layer Time Delay Neural Networks
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mohammadi, Amirmohammad, Masabarakiza, Iren'e, Barnes, Ethan, Carreiro, Davelle, Van Dine, Alexandra, Peeples, Joshua |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Structural and Statistical Audio Texture Knowledge Distillation for Acoustic Classification
par: Ritu, Jarin, et autres
Publié: (2025)
par: Ritu, Jarin, et autres
Publié: (2025)
Neural Edge Histogram Descriptors for Underwater Acoustic Target Recognition
par: Agashe, Atharva, et autres
Publié: (2025)
par: Agashe, Atharva, et autres
Publié: (2025)
Cross-Domain Knowledge Transfer for Underwater Acoustic Classification Using Pre-trained Models
par: Mohammadi, Amirmohammad, et autres
Publié: (2024)
par: Mohammadi, Amirmohammad, et autres
Publié: (2024)
Histogram-based Parameter-efficient Tuning for Passive and Active Sonar Classification
par: Mohammadi, Amirmohammad, et autres
Publié: (2025)
par: Mohammadi, Amirmohammad, et autres
Publié: (2025)
Quantitative Measures for Passive Sonar Texture Analysis
par: Ritu, Jarin, et autres
Publié: (2025)
par: Ritu, Jarin, et autres
Publié: (2025)
Neural Network-Based Time-Frequency-Bin-Wise Linear Combination of Beamformers for Underdetermined Target Source Extraction
par: Chen, Changda, et autres
Publié: (2026)
par: Chen, Changda, et autres
Publié: (2026)
Uncertainty Quantification in Melody Estimation using Histogram Representation
par: Saxena, Kavya Ranjan, et autres
Publié: (2025)
par: Saxena, Kavya Ranjan, et autres
Publié: (2025)
Musical Metamerism with Time--Frequency Scattering
par: Lostanlen, Vincent, et autres
Publié: (2026)
par: Lostanlen, Vincent, et autres
Publié: (2026)
An Investigation of Time-Frequency Representation Discriminators for High-Fidelity Vocoder
par: Gu, Yicheng, et autres
Publié: (2024)
par: Gu, Yicheng, et autres
Publié: (2024)
Learning Time-Graph Frequency Representation for Monaural Speech Enhancement
par: Wang, Tingting, et autres
Publié: (2025)
par: Wang, Tingting, et autres
Publié: (2025)
On Time Delay Interpolation for Improved Acoustic Reflector Localization
par: Rosseel, Hannes, et autres
Publié: (2025)
par: Rosseel, Hannes, et autres
Publié: (2025)
Parameter-efficient Dual-encoder Architecture with Differentiable Choquet Integral Fusion for Underwater Acoustic Classification
par: Mohammadi, Amirmohammad, et autres
Publié: (2026)
par: Mohammadi, Amirmohammad, et autres
Publié: (2026)
Target Speaker Extraction by Directly Exploiting Contextual Information in the Time-Frequency Domain
par: Yang, Xue, et autres
Publié: (2024)
par: Yang, Xue, et autres
Publié: (2024)
Time-Graph Frequency Representation with Singular Value Decomposition for Neural Speech Enhancement
par: Wang, Tingting, et autres
Publié: (2024)
par: Wang, Tingting, et autres
Publié: (2024)
A Dual-Path Framework with Frequency-and-Time Excited Network for Anomalous Sound Detection
par: Zhang, Yucong, et autres
Publié: (2024)
par: Zhang, Yucong, et autres
Publié: (2024)
Wavelet-Based Time-Frequency Fingerprinting for Feature Extraction of Traditional Irish Music
par: Shore, Noah
Publié: (2025)
par: Shore, Noah
Publié: (2025)
Audio Inpainting in Time-Frequency Domain with Phase-Aware Prior
par: Balušík, Peter, et autres
Publié: (2026)
par: Balušík, Peter, et autres
Publié: (2026)
Exploring Frequency-Domain Feature Modeling for HRTF Magnitude Upsampling
par: Chen, Xingyu, et autres
Publié: (2026)
par: Chen, Xingyu, et autres
Publié: (2026)
Asymmetric Encoder-Decoder Based on Time-Frequency Correlation for Speech Separation
par: Shin, Ui-Hyeop, et autres
Publié: (2026)
par: Shin, Ui-Hyeop, et autres
Publié: (2026)
TF-Mamba: A Time-Frequency Network for Sound Source Localization
par: Xiao, Yang, et autres
Publié: (2024)
par: Xiao, Yang, et autres
Publié: (2024)
Time-Layer Adaptive Alignment for Speaker Similarity in Flow-Matching Based Zero-Shot TTS
par: Li, Haoyu, et autres
Publié: (2025)
par: Li, Haoyu, et autres
Publié: (2025)
On HRTF Notch Frequency Prediction Using Anthropometric Features and Neural Networks
par: Arbel, Lior, et autres
Publié: (2024)
par: Arbel, Lior, et autres
Publié: (2024)
An Investigation on Combining Geometry and Consistency Constraints into Phase Estimation for Speech Enhancement
par: Ho, Chun-Wei, et autres
Publié: (2025)
par: Ho, Chun-Wei, et autres
Publié: (2025)
STFTCodec: High-Fidelity Audio Compression through Time-Frequency Domain Representation
par: Feng, Tao, et autres
Publié: (2025)
par: Feng, Tao, et autres
Publié: (2025)
Multi-Granularity Adaptive Time-Frequency Attention Framework for Audio Deepfake Detection under Real-World Communication Degradations
par: Shi, Haohan, et autres
Publié: (2025)
par: Shi, Haohan, et autres
Publié: (2025)
Leveraging Local and Global Knowledge Integration with Time-Frequency Calibrated Distillation for Speech Enhancement
par: Cheng, Jiaming, et autres
Publié: (2025)
par: Cheng, Jiaming, et autres
Publié: (2025)
Algorithms of Sampling-Frequency-Independent Layers for Non-integer Strides
par: Imamura, Kanami, et autres
Publié: (2023)
par: Imamura, Kanami, et autres
Publié: (2023)
Frequency Tracking Features for Data-Efficient Deep Siren Identification
par: Damiano, Stefano, et autres
Publié: (2024)
par: Damiano, Stefano, et autres
Publié: (2024)
Multi-Sampling-Frequency Naturalness MOS Prediction Using Self-Supervised Learning Model with Sampling-Frequency-Independent Layer
par: Nishikawa, Go, et autres
Publié: (2025)
par: Nishikawa, Go, et autres
Publié: (2025)
Time-Frequency-Based Attention Cache Memory Model for Real-Time Speech Separation
par: Chen, Guo, et autres
Publié: (2025)
par: Chen, Guo, et autres
Publié: (2025)
LocaGen: Sub-Sample Time-Delay Learning for Beam Localization
par: Kunwar, Ishaan, et autres
Publié: (2025)
par: Kunwar, Ishaan, et autres
Publié: (2025)
ComFeAT: Combination of Neural and Spectral Features for Improved Depression Detection
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
FRCRN: Boosting Feature Representation using Frequency Recurrence for Monaural Speech Enhancement
par: Zhao, Shengkui, et autres
Publié: (2022)
par: Zhao, Shengkui, et autres
Publié: (2022)
MossFormer2: Combining Transformer and RNN-Free Recurrent Network for Enhanced Time-Domain Monaural Speech Separation
par: Zhao, Shengkui, et autres
Publié: (2023)
par: Zhao, Shengkui, et autres
Publié: (2023)
Expressive Timing in Hindustani Vocal Music
par: Bhake, Yash, et autres
Publié: (2025)
par: Bhake, Yash, et autres
Publié: (2025)
Distribution Preserving Source Separation With Time Frequency Predictive Models
par: T., Pedro J. Villasana, et autres
Publié: (2023)
par: T., Pedro J. Villasana, et autres
Publié: (2023)
ST-ITO: Controlling Audio Effects for Style Transfer with Inference-Time Optimization
par: Steinmetz, Christian J., et autres
Publié: (2024)
par: Steinmetz, Christian J., et autres
Publié: (2024)
An LSTM-Based Chord Generation System Using Chroma Histogram Representations
par: Hardwick, Jack
Publié: (2024)
par: Hardwick, Jack
Publié: (2024)
Towards Real-Time Generative Speech Restoration with Flow-Matching
par: Hsieh, Tsun-An, et autres
Publié: (2025)
par: Hsieh, Tsun-An, et autres
Publié: (2025)
Test-Time Adaptation For Speech Enhancement Via Mask Polarization
par: Raichle, Tobias, et autres
Publié: (2026)
par: Raichle, Tobias, et autres
Publié: (2026)
Documents similaires
-
Structural and Statistical Audio Texture Knowledge Distillation for Acoustic Classification
par: Ritu, Jarin, et autres
Publié: (2025) -
Neural Edge Histogram Descriptors for Underwater Acoustic Target Recognition
par: Agashe, Atharva, et autres
Publié: (2025) -
Cross-Domain Knowledge Transfer for Underwater Acoustic Classification Using Pre-trained Models
par: Mohammadi, Amirmohammad, et autres
Publié: (2024) -
Histogram-based Parameter-efficient Tuning for Passive and Active Sonar Classification
par: Mohammadi, Amirmohammad, et autres
Publié: (2025) -
Quantitative Measures for Passive Sonar Texture Analysis
par: Ritu, Jarin, et autres
Publié: (2025)